{"as_of":"2026-08-10T18:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cbb529ad1c99bf3844dff205457cde67d2dfb7960e24480b5bfd32b0a569962e","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:45:56.376360Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T15:19:23.003493Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T15:24:50.087593Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2509.10486","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10486","snapshot_observed_at":"2026-06-30T15:24:50.087593Z","title":"SABR: A stable adaptive bitrate framework using behavior cloning pretraining and reinforcement learning fine-tuning","venue":null,"work_id":"e36ab8eb-6f85-4b7d-8374-a0d2bf1fa234","year":2025},"citing_paper":{"arxiv_id":"2605.23560","last_updated":"2026-05-27T02:45:51Z","snapshot_observed_at":"2026-08-07T14:12:32.000884Z","submitted_at":"2026-05-22T12:27:47Z","title":"SafeSABR: Risk-Calibrated Adaptive Bitrate Streaming over Starlink Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-25T03:46:40.917749Z"},"links":{"cited_paper":"/paper/2509.10486","citing_paper":"/paper/2605.23560"},"observation_digest":"sha256:464685c4153e78c034d83ad003f79fc908335633b9147033a4629e9d4303c42c","observation_id":"41a334d9-7f65-41fa-a17e-e99dcdac6048","resolution":{"observed_at":"2026-05-25T03:50:19.768641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2509.10486","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10486","snapshot_observed_at":"2026-06-30T15:24:50.087593Z","title":"SABR: A stable adaptive bitrate framework using behavior cloning pretraining and reinforcement learning fine-tuning","venue":null,"work_id":"e36ab8eb-6f85-4b7d-8374-a0d2bf1fa234","year":2025},"citing_paper":{"arxiv_id":"2605.23560","last_updated":"2026-05-27T02:45:51Z","snapshot_observed_at":"2026-08-07T14:12:32.000884Z","submitted_at":"2026-05-22T12:27:47Z","title":"SafeSABR: Risk-Calibrated Adaptive Bitrate Streaming over Starlink Networks","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T15:19:23.003493Z"},"links":{"cited_paper":"/paper/2509.10486","citing_paper":"/paper/2605.23560"},"observation_digest":"sha256:10841b3e3f8e0329eca47e087d04fc449499a558e2fe031b760f7c7e10351226","observation_id":"aae596d9-f368-4347-b4b7-ef0061e2cd4c","resolution":{"observed_at":"2026-06-30T15:24:50.089026Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.10486/citation-record","integrity":"/paper/2509.10486/integrity","json":"/paper/2509.10486/citation-record.json","paper":"/paper/2509.10486"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:51.809182Z","title":"Improving language understanding by generative pre-training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:51.809182Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:1be16c709297b784b780982a41b0f3afc906f83da85b4444d6bf8d04754c34cd","observation_id":"1672e7a6-d2a4-4cff-95b8-ff6ebd5e6436","resolution":{"observed_at":"2026-08-05T13:45:51.809182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:51.934742Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:51.934742Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:577f02a7e53116146301ee0816c776d0a8ae38a6b2db475a2737a70f0c8604eb","observation_id":"1acb59a3-a895-44b7-bc09-b8d53b155f28","resolution":{"observed_at":"2026-08-05T13:45:51.934742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:52.000461Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:52.000461Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:6e800624beeb9d12c1f9610e3ab794a5fb826a030ccf3fc59e508e7f629b3890","observation_id":"40eaaae9-3fc7-4985-93c8-0dce6c299715","resolution":{"observed_at":"2026-08-05T13:45:52.000461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:52.215776Z","title":"Direct preference optimization: Your language model is secretly a reward model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:52.215776Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:4c69ba78236fc34416a5a426281060cb75916961306ab8bcb91b31e60d2b3de8","observation_id":"8719c954-24a4-49dc-a68f-d49362a500e8","resolution":{"observed_at":"2026-08-05T13:45:52.215776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T13:45:52.375396Z","title":"Prox- imal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:52.375396Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:04bc09fe81931ca100a82f242934063809d9e382f980403ed4ffbe31944ebaa4","observation_id":"d14070d7-f254-42e2-b55f-66bfc93880a6","resolution":{"observed_at":"2026-08-05T13:45:52.375396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:00.916716Z","title":"Neural adaptive video stream- ing with pensieve,","venue":null,"work_id":"e9a3a529-1270-4e94-9cf6-7a455c0a606c","year":2017},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:52.523582Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:8106086a86264e12e206be3ff5d0186a607ca39ef2e881017bd37a49303af09d","observation_id":"f14326a4-bff3-4393-9afc-765af8251ae6","resolution":{"observed_at":"2026-08-05T13:46:01.010120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:00.770165Z","title":"Asynchronous methods for deep rein- forcement learning,","venue":null,"work_id":"54e68c28-9b98-4fbc-89ac-2fda77f0215b","year":2016},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:52.726214Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:292ea796f0056e07ecf61ed57b00fbeb6c565f666cdbcb5660054e5ecf4b7f47","observation_id":"8f529a7c-7ffe-4c0d-9d5c-29a3b0891ab8","resolution":{"observed_at":"2026-08-05T13:46:00.843857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:00.653601Z","title":"Comyco: Quality-aware adaptive video streaming via imitation learning,","venue":null,"work_id":"6b460abc-2ff5-4ef1-b133-31fe93065533","year":2019},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:52.888402Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:b362a84d111f8576dfe7f456132384ee47f78a5dd25b4135cc6036c6307712e1","observation_id":"60a5ed7f-8fd8-4ee5-8152-ff446dab78b0","resolution":{"observed_at":"2026-08-05T13:46:00.716424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:00.512138Z","title":"Optimizing adaptive video streaming with human feedback,","venue":null,"work_id":"19e5eb08-d0f0-4dab-b200-4d8c680a2d62","year":2023},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:53.088482Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:6fd5fb7aba93caec4598478fa023023170615f0df3a1cba13f2edf2b0a97f7e4","observation_id":"0aa6370e-8299-425a-b561-a283627342b1","resolution":{"observed_at":"2026-08-05T13:46:00.577400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:00.350277Z","title":"Genet: Automatic curriculum generation for learning adaptation in networking,","venue":null,"work_id":"400c7ee0-0743-403b-a5fc-0da851972b16","year":2022},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:53.232486Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:13ed5a106f5bf5c504cf621474e26b843efe39ba1c5602d410195da9d620a2f5","observation_id":"7f703b86-07d4-4845-b808-f4e2ab253bb5","resolution":{"observed_at":"2026-08-05T13:46:00.424063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:00.171893Z","title":"Curriculum learning,","venue":null,"work_id":"ca34a068-aced-4130-a405-9cdaf9d966a7","year":2009},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:53.439959Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:85c7539e5f7109b5e8bdd8b839f85843001e288ee5ef74aee0b6f4193dd24e0b","observation_id":"9d55f6c6-c3ff-4346-9d48-96a999aaf4cd","resolution":{"observed_at":"2026-08-05T13:46:00.250705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:59.977564Z","title":"Netllm: Adapting large language models for networking,","venue":null,"work_id":"10f7c264-759a-42c7-adae-db3b46ab2b89","year":2024},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:53.599782Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:26ba853c73c571bdf82873fe9fbef4bec7ace6f4afe40500626734dc58e37daa","observation_id":"684f055b-6b21-4301-a55a-1093d74d37e8","resolution":{"observed_at":"2026-08-05T13:46:00.105578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:53.727273Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:53.727273Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:a940c10ace09e749fa831344a1fdedc7cdc08d46096aaecada5399093f3fd673","observation_id":"f7b38264-ff16-4e5f-8a29-22e0b8801f16","resolution":{"observed_at":"2026-08-05T13:45:53.727273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:59.782813Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning,","venue":null,"work_id":"87cbe919-2c6c-458d-addb-fb7ef3c6264c","year":2011},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:53.871765Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:e83764efc936a9f3f0c0e67f201c62c917921bd6ea921959e26aca3dabe10372","observation_id":"7d4d7b45-50d5-4a70-aec0-3f43e234c57e","resolution":{"observed_at":"2026-08-05T13:45:59.860790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:59.629663Z","title":"Comyco for linear-based QoE (comyco-lin),","venue":null,"work_id":"fe710e62-d7a3-4582-a9d7-b005b5bc3361","year":2025},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:54.007721Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:9120b3b05b0e8b63810c2aeb26f48c4becf0d8bd45a2da747306bbf49ee86478","observation_id":"ed1838f1-aa4a-4709-ad10-00bff9252c3d","resolution":{"observed_at":"2026-08-05T13:45:59.701063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:54.125586Z","title":"Mujoco: A physics engine for model- based control,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:54.125586Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:71ea126130981778f8f94593e2f2f20d3543e39df0f5b0b8a2fe0a4247742bb8","observation_id":"bb220847-120c-4ecb-abde-4255c8072f37","resolution":{"observed_at":"2026-08-05T13:45:54.125586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:59.448501Z","title":"Multi-resource constrained dynamic workshop scheduling based on proximal policy optimisation,","venue":null,"work_id":"26ddaba4-7297-4e81-a644-ea0a77cc29e4","year":2022},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:54.227095Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:0ffe7b29b636a7f35f278dae72885fc9c83fc5fe7f11e97c524865c640b3f85a","observation_id":"9a76caee-484b-4da9-a0d9-5b5f4aa50cd5","resolution":{"observed_at":"2026-08-05T13:45:59.534015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-09T23:04:15.431743Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-05T13:45:54.371287Z","title":"High- dimensional continuous control using generalized advantage estimation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:54.371287Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:f46bcfbe8ab5e5c472e42651dcb41898bec0fe570ade29f2a26a9abcc7b1fe1a","observation_id":"b7d5c06c-6d7f-4af4-8a73-1236895dee8f","resolution":{"observed_at":"2026-08-05T13:45:54.371287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:59.245262Z","title":"A variegated look at 5g in the wild: performance, power, and qoe implications,","venue":null,"work_id":"f959f3dd-14c1-4b68-a1e6-0b51ac4f8593","year":2021},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:54.503107Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:2c9b10a4269a10a98860913b564eabb7f98e6eec6c26e959b70622b72a1b282c","observation_id":"77268fd7-58aa-4e3c-b5bc-cf24ce80304a","resolution":{"observed_at":"2026-08-05T13:45:59.370493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:59.042731Z","title":"Lumos5g: Mapping and predicting commercial mmwave 5g throughput,","venue":null,"work_id":"22532eef-2454-4a7c-9bcb-48ea662a6866","year":2020},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:54.625502Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:6eae7096195ec2e202e48725ffac9e0e861c39013e452de6a9f860b8d1075844","observation_id":"321eaa12-1940-48a3-bcea-cbbecd2b97ec","resolution":{"observed_at":"2026-08-05T13:45:59.135914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:58.821191Z","title":"Commute path bandwidth traces from 3g networks: Analysis and applications,","venue":null,"work_id":"6bde681f-7ee1-477d-aaed-8a8fcc01b2b0","year":2013},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:54.745001Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:29915d25046e1bb60f6be189387a638752c7d6ff8a4d35a9de929386d75e6d40","observation_id":"c078ce0b-5fe5-4192-9393-6dabb9d4856a","resolution":{"observed_at":"2026-08-05T13:45:58.935102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:58.649353Z","title":"Raw data - measuring broadband america 2016,","venue":null,"work_id":"8bdf832a-933f-4d15-b152-68dede0be329","year":2016},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:54.886471Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:6e0ead2c1b4c637061e612127e6e9bd4304328db04ee62e06b64610fa016d811","observation_id":"59555556-ad54-4cc6-9bb2-a7adc178c7db","resolution":{"observed_at":"2026-08-05T13:45:58.740245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:58.480386Z","title":"Raw data releases - measuring broadband america 2018,","venue":null,"work_id":"c96daaed-e859-4a04-8cf8-0d00e977337b","year":2018},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:55.040414Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:60e2192f13d8517f65215923189e7ad8344b14de55da948f8317e7ff622305ad","observation_id":"8ad7614e-882c-4297-af5a-6a6c30530780","resolution":{"observed_at":"2026-08-05T13:45:58.560498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:58.259275Z","title":"Pitree: Practical implementation of abr algorithms using decision trees,","venue":null,"work_id":"ac79c22d-d1ec-4ed3-8b05-4cc7e878f72c","year":2019},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:55.144589Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:64cab97b226f91573529d2635f0a2fb4b5bdf44ec113c4e58b8f512621d64468","observation_id":"b3fea566-dc4f-4a1e-8bef-81be02ae2bd5","resolution":{"observed_at":"2026-08-05T13:45:58.342266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:58.057370Z","title":"Oboe: Auto-tuning video abr algo- rithms to network conditions,","venue":null,"work_id":"f0653dea-6e53-4aeb-8f20-6a55965a839f","year":2018},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:55.279611Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:50f07e1eac1f26ea445c08c84d0e0d0910837fcb68679a9d4ebd58e9c85a3c3c","observation_id":"f8dd68d8-561d-47f8-91b9-56d44ebbdd5a","resolution":{"observed_at":"2026-08-05T13:45:58.172349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:57.886921Z","title":"Improving gen- eralization for neural adaptive video streaming via meta reinforcement learning,","venue":null,"work_id":"766ec338-9435-4c83-ac2d-d83f204b9c59","year":2022},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:55.392192Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:58a09dedf37a83570fc0f74530bd2db6a2373ef3b4f26fbc6fa30b86a29f663a","observation_id":"2308ac1c-7cf0-47e4-ac39-54fca6ec05d7","resolution":{"observed_at":"2026-08-05T13:45:57.974434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:57.698598Z","title":"Learning in situ: a randomized experiment in video streaming,","venue":null,"work_id":"b6e1f8b7-ba4c-4ca6-8991-594b3f512237","year":2020},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:55.498385Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:6fdae0d2c747b0cc9de69dc3cdbe28ecac8322c946f3a29ea05c60e6e3ed222e","observation_id":"fbaa8db7-91df-4a2b-aec7-1548071ea1e1","resolution":{"observed_at":"2026-08-05T13:45:57.807909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:57.527265Z","title":"Lumos: Towards better video streaming qoe through accurate throughput prediction,","venue":null,"work_id":"71f6d1be-3492-4eb5-bb46-10e5f31257c1","year":2022},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:55.593006Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:5222f20727d4a6a329aabcd5dbf55010de8d9d8e009a7dbc41f55f8e3314617c","observation_id":"7fe78605-7287-4f2d-8f47-17db7fa2d37d","resolution":{"observed_at":"2026-08-05T13:45:57.618274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:57.354370Z","title":"dash.js: Mpeg-dash reference client,","venue":null,"work_id":"97908810-85fc-482c-b8e9-ea974b927dd5","year":2012},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:55.681343Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:ada2d8dc4e3c79f364e6f173afac99d59ea1bf86a79722564a94316088894cfb","observation_id":"1500d513-503b-4f84-8910-a74a97c3a848","resolution":{"observed_at":"2026-08-05T13:45:57.435530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:57.187220Z","title":"Big buck bunny,","venue":null,"work_id":"ab4bb718-bf8c-42d4-b485-f90b8f3c0a9f","year":2008},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:55.733869Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:59e1767f46e14ef862f9237c84ed195443a7843a11cdff81bc770d9239dd164f","observation_id":"2168470c-1547-42ca-b814-5e197ddc48c8","resolution":{"observed_at":"2026-08-05T13:45:57.270848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:55.821967Z","title":"Pytorch: An imperative style, high-performance deep learning library,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:55.821967Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:e5a27c53a5845ec0141775b674a867faeeca331e19ad9bc2470d51ba6cbcce84","observation_id":"db173dbf-6a01-4733-b09e-227b2626c38f","resolution":{"observed_at":"2026-08-05T13:45:55.821967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:57.009907Z","title":"Stable-baselines3: Reliable reinforcement learning implementa- tions,","venue":null,"work_id":"925c8362-7a67-40e4-87a0-654e56132eec","year":2021},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:55.945313Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:09ad33bd2f0a3afd4c10623471f9e88f08a1ac1af17143e2148c449723c5447f","observation_id":"b0b2f76d-2e0f-4047-9d97-e56d0dc77aec","resolution":{"observed_at":"2026-08-05T13:45:57.093267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T13:45:56.081199Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:56.081199Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:786f95495699b4ebd865fc914c08c5d3a74f36e988de03a2acd413e34b53223e","observation_id":"9dcb1313-7c58-45b4-b104-7a4fb4019118","resolution":{"observed_at":"2026-08-05T13:45:56.081199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:56.840751Z","title":"A control-theoretic approach for dynamic adaptive video streaming over http,","venue":null,"work_id":"dfe230bb-b844-4807-bce5-ee3567989310","year":2015},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:56.233194Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:08b122d2403daa4eebcd179dff8b314493e9bfe0486439d338ef4dbf6514015e","observation_id":"ed506903-1f6f-45a9-8664-f7bb729c4911","resolution":{"observed_at":"2026-08-05T13:45:56.928316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:56.668243Z","title":"Bola: Near-optimal bitrate adaptation for online videos,","venue":null,"work_id":"bb8ea063-1f3d-4faa-bebe-213e074ebc3f","year":2020},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:56.307572Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:1af97213a00f3ff3644830e05f203b7403b1b96f7da72627d6626ed624a4f532","observation_id":"331e421c-c170-43b5-be40-3e1d73fe9041","resolution":{"observed_at":"2026-08-05T13:45:56.715672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:45:56.494359Z","title":"Quetra: A queuing theory approach to dash rate adaptation,","venue":null,"work_id":"affc6e34-056c-4173-98ab-cb7e8be3369f","year":2017},"citing_paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T13:45:56.376360Z"},"links":{"citing_paper":"/paper/2509.10486"},"observation_digest":"sha256:a7720f4206fd217ccc23d7e9e9e8111904ddc32e0def1df7b1759c751c1af601","observation_id":"cca61df8-8baf-4154-8ff5-a65c28def6f8","resolution":{"observed_at":"2026-08-05T13:45:56.576868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.10486","last_updated":"2025-08-30T05:32:45Z","latest_version":1,"primary_category":"cs.NI","snapshot_observed_at":"2026-08-09T03:21:32.108961Z","submitted_at":"2025-08-30T05:32:45Z","title":"SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 2 inbound Pith citation observations for arXiv:2509.10486."}