Cho mạng 2 lớp: đầu vào x∈Rn, một lớp ẩn h nơ-ron với kích hoạt sigmoid, một nơ-ron đầu ra sigmoid. Tham số: W1∈Rh×n, b1∈Rh, W2∈R1×h, b2∈R.
Lan truyền tiến: z1=W1x+b1,a1=σ(z1),z2=W2a1+b2,y^=σ(z2)
Với nhãn thật y, dùng mất mát L=−[ylny^+(1−y)ln(1−y^)]. Khi đó: ∂z2∂L=y^−y
Lan truyền ngược tính gradient theo W2: ∂W2∂L=(y^−y)a1⊤
In ra vector gradient ∂W2∂L gồm h giá trị (làm tròn 2 chữ số), cách nhau bởi dấu cách.
Dòng 1: n h. Dòng 2: x (n số). h dòng: hàng của W1. Dòng kế: b1 (h số). Dòng kế: W2 (h số). Dòng kế: b2 (1 số). Dòng cuối: y (0 hoặc 1).
1≤n,h≤8; ∣giá trị∣≤20; y∈{0,1}.
Một dòng gồm h số thực (gradient theo W2) làm tròn 2 chữ số.
Ví dụ:
Đầu vào:
2 2
0 0
1 1
1 1
0 0
1 1
0
1
Đầu ra:
-0.13 -0.13
Giải thích:
Đang tải editor...