|
2 | 2 | "cells": [ |
3 | 3 | { |
4 | 4 | "cell_type": "markdown", |
5 | | - "id": "4f51095f", |
| 5 | + "id": "a65b0859", |
6 | 6 | "metadata": { |
7 | 7 | "colab_type": "text", |
8 | 8 | "execution": {}, |
|
113 | 113 | }, |
114 | 114 | "outputs": [], |
115 | 115 | "source": [ |
116 | | - "# @title Install dependencies\n", |
117 | | - "!pip install nltk --quiet\n", |
118 | | - "!pip install fasttext --quiet\n", |
119 | | - "!pip install -U datasets --quiet\n", |
120 | | - "!pip install -U tokenizers --quiet" |
| 116 | + "# @title Uncomment to install dependencies\n", |
| 117 | + "# !pip install nltk --quiet\n", |
| 118 | + "# !pip install fasttext --quiet\n", |
| 119 | + "# !pip install -U datasets --quiet\n", |
| 120 | + "# !pip install -U tokenizers==0.22.2 --quiet" |
121 | 121 | ] |
122 | 122 | }, |
123 | 123 | { |
|
1764 | 1764 | "source": [ |
1765 | 1765 | "tokenizer = get_tokenizer(fasttext_vocab)\n", |
1766 | 1766 | "num_class, train_data, valid_data, test_data = load_dataset(\n", |
1767 | | - " \"fancyzhx/ag_news\", tokenizer, device=DEVICE, seed=1, batch_size=32, valid_split=0.7\n", |
| 1767 | + " \"ag_news\", tokenizer, device=DEVICE, seed=1, batch_size=32, valid_split=0.7\n", |
1768 | 1768 | ")\n", |
1769 | 1769 | "hidden_size = 128\n", |
1770 | 1770 | "embedding_length = fasttext_vectors.size(1) # 300\n", |
|
1910 | 1910 | "name": "python3" |
1911 | 1911 | }, |
1912 | 1912 | "kernelspec": { |
1913 | | - "display_name": "Python 3", |
| 1913 | + "display_name": "nma-dl", |
| 1914 | + "language": "python", |
1914 | 1915 | "name": "python3" |
1915 | 1916 | }, |
1916 | 1917 | "language_info": { |
|
0 commit comments