Εργαστήριο 03 — Ταξινόμηση Κειμένου με Ακολουθία και Attention

2 λεπτά
  1. Γιατί ρυθμίζουμε τον tokenizer μόνο στο train;
  2. Ποιο σχήμα έχουν τα IDs για μια παρτίδα B μήκους L;
  3. Ποιο τεστ αποκαλύπτει ένα κακώς μασκαρισμένο padding;
  4. Γιατί Macro-F1 αντί για accuracy με σπάνιες κλάσεις;
  5. [E] Σε τι χρησιμεύει η baseline TF-IDF απέναντι σε μια GRU;

Απαντήσεις. 1. Αλλιώς το λεξιλόγιο διαρρέει στατιστικά του συνόλου δοκιμής. 2. B×L, όπως η μάσκα. 3. Η προσθήκη padding δεν πρέπει να αλλάζει την πρόβλεψη. 4. Κάθε κλάση μετρά εξίσου. 5. Μετρά αν η ακολουθιακή σειρά προσφέρει κέρδος πέρα από τις παρούσες λέξεις.

Προεπισκόπηση — η συνέχεια του μαθήματος είναι διαθέσιμη στους εγγεγραμμένους.

Έχετε ήδη εγγραφεί με κωδικό;

Η πρόσβασή σας συνδέεται με τον λογαριασμό σας, όχι με αυτόν τον σύνδεσμο. Συνδεθείτε με το ίδιο email που χρησιμοποιήσατε στην τάξη: το μάθημά σας σας περιμένει, δεν χρειάζεται να ξαναβάλετε τον κωδικό.

ΣύνδεσηΔεν έχετε λογαριασμό; Δημιουργήστε έναν
Αυτό το μάθημα ανήκει στην ενότητα «Εργαστήρια (5 Εργαστήρια)»

Οι πρώτες ενότητες του μαθήματος είναι σε ελεύθερη πρόσβαση. Για τη συνέχεια υπάρχουν τρεις δρόμοι: αγοράστε αυτό το μάθημα μία φορά, κάντε συνδρομή, ή εισαγάγετε τον κωδικό που δόθηκε στην τάξη.

Συνδρομή — 19 $ US/μήναΕπιστροφή στο πλάνο
Είστε φοιτητής σε αυτό το μάθημα;

Ο κωδικός συνδέεται με τον λογαριασμό σας: συνδεθείτε ή δημιουργήστε λογαριασμό και θα εφαρμοστεί αυτόματα όταν επιστρέψετε.

Δεν έχετε λογαριασμό; Δημιουργήστε έναν