Wie ist die Sigmoid definiert
und wie sind die Grenzwerte für + und - unendlich
Wie definieren wir den Fehler der j-ten Schicht?
Wie haben wir die quadratische Kostenfunktion definiert ?
Wie haben wir die Hilfsvariable
definiert?
Notwendige Bedingung für Extremum mit Nebenbedingung?
∇f(x) = λ · ∇g(x) und g(x) = 0
Das λ (Lagrange-Multiplikator) ist einfach der Faktor, um wie viel die beiden Gradienten-Vektoren sich in der Länge unterscheiden — die Richtung muss aber gleich sein.
λmuss alle Elemente im Bereich der reelen Zahlen erfüllt sein.
Definiere die Topologie eines FFNS?
Wie haben wir das Hammard Produkt definiert ?
Wie ist
definiert ?
Wie haben wir die RelU Aktivierungsfunktion definiert ?
Für Werte kleiner 0 wird ein Null ausgegeben oder sonst der höhere Wert
Wie haben wir ein biologisches Neuron definiert ?
Wie haben wir die einfache lineare Regression definiert?
Geg seien m Beobachtungen der Form <x1,y1>, …… , <xm,ym>
Leiten sie BP2 her
Leiten sie BP3 her
Leiten sie BP4 her
Leiten sie BP1 her
Wie lautet die Definition des Mean Squared Error (MSE) in Matrix-Schreibweise?
Win definieren den mittleren quadratischen Fehler als (ohne Matrixschreibweise)?
Wie lautet die Normalengleichung zur Bestimmung der optimalen Gewichte w? Unter welcher Bedingung ist sie lösbar?
Welche Auswirkungen haben eine zu große und eine zu kleine Lernrate n?
Was gibt das Bestimmtheitsmaß R^2 an und wie ist sein Wertebereich definiert?
Wie haben wir die Formel definiert ?
Bedeutung: Es gibt den Anteil der Varianz der Zielvariablen an, der durch das lineare Modell erklärt wird.
Formel: R^2 = 1 - Nicht erklärte Varianz (Residuenz {Gesamtvarianz der Daten}}$
Wie haben wir RSS und TSS definiert ?
Wie haben wir xn+1 deiniert beim Gradienten anstieg
Lernraten-Anpassung beim Gradienten-Anstieg — beide Fälle
Fall 1: f(x_{n+1}) ≥ f(x_n) ⇒ α := α · 1.2
Fall 2: f(x_{n+1}) < f(x_n) ⇒ α := α · 0.5
alpha = lernrate n
Rechenbeispiel — zwei Schritte Gradienten-Anstieg mit Lernraten-Anpassung
f(x) = -(x-3)²+5,
∇f(x) = -2·(x-3),
x0=0,
α=0.1
Schritt 1: ∇f(x0) = -2·(0-3) = 6
x1 = x0 + α·∇f(x0) = 0 + 0.1·6 = 0.6
Check: f(x1)=-0.76 ≥ f(x0)=-4 → α := 0.1·1.2 = 0.12
Schritt 2: ∇f(x1) = -2·(0.6-3) = 4.8
x2 = x1 + α·∇f(x1) = 0.6 + 0.12·4.8 = 1.176
Check: f(x2)=1.673 ≥ f(x1)=-0.76 → α := 0.12·1.2 = 0.144
Wie definieren wir die Lagrange Funktion
Wie lauten die backpropargation gleichungen?
Löse Aufgabe 3
Beweise Gleichung 6.2 und 6.3
Um v1 auf Endformel zu bringen endformel nenner Zähler mit binomischer Formel ausmultiplizieren
Wie haben wir den bias definiert ?
Was bedeutet Overfitting was Underfitting?
Wie haben wir Klassifikations Problem definiert?
Leiten sie die Logit fkt her (Umkehr Sigmoid)
S(t) = 1/(1+e^(-t))
Wie haben wir die Genauigkeit definiert ?
Wie haben wir die Plausibilität definiert
Berechnung von gradienten?
Wie definieren wir die logarithmische Plausabilität?
Welche Funktion gilt wenn bei Lagrange ein Extremum vorliegt ?
wie haben wir x und y Vektor in der einfachen linearen regression definiert ?
Wie haben wir die
Wie ist der Gradient einer differenzierbaren Funktion f:Rn→R definiert ?
anschaulich zeigt der Gradient in Richtung des stärksten Anstiegs der FKT.. Zur Berechnung des Maximus verwenden wir ein iteratives Verfahren
Wie haben wir die Feature Matrix X definiert?
Wie haben wir die Update-Regel des Gradientenaufstiegs definiert?
Last changed6 days ago