Wie lässt sich das nicht-lineare Potenzmodell y = alpha * x^beta linearisieren, um es mit linearer Regression zu schätzen?“*
Wie ist die Sigmoid definiert
und wie sind die Grenzwerte für + und - unendlich
Wie definieren wir den Fehler der j-ten Schicht?
Wie haben wir die Hilfsvariable
definiert?
Notwendige Bedingung für Extremum mit Nebenbedingung?
∇f(x) = λ · ∇g(x) und g(x) = 0
Definiere die Topologie eines FFNS?
Wie haben wir das Hammard Produkt definiert ?
Wie ist
definiert ?
Wie haben wir die RelU Aktivierungsfunktion definiert ?
Für Werte kleiner 0 wird ein Null ausgegeben oder sonst der höhere Wert
Wie haben wir ein biologisches Neuron definiert ?
Wie haben wir die einfache lineare Regression definiert?
Geg seien m Beobachtungen der Form <x1,y1>, …… , <xm,ym>
Leiten sie BP2 her
Wie lauten die Formeln für die Eingabeschicht und die verborgenen Schichten in der komponentenweisen (elementweisen) Form (FF1 & FF2)? Erkläre kurz die Bedeutung der Indizes.
Wie lauten die entsprechenden Gleichungen in der vektorisierten Form (FF1v & FF2v)?
Leiten sie BP3 her
Leiten sie BP4 her
Leiten sie BP1 her
Wie lautet die Definition des Mean Squared Error (MSE) in Matrix-Schreibweise?
Win definieren den mittleren quadratischen Fehler als (ohne Matrixschreibweise)?
Wie lautet die Normalengleichung zur Bestimmung der optimalen Gewichte w? Unter welcher Bedingung ist sie lösbar?
Welche Auswirkungen haben eine zu große und eine zu kleine Lernrate n?
Was gibt das Bestimmtheitsmaß R^2 an und wie ist sein Wertebereich definiert?
Wie haben wir die Formel definiert ?
Bedeutung: Es gibt den Anteil der Varianz der Zielvariablen an, der durch das lineare Modell erklärt wird.
Formel: R^2 = 1 - Nicht erklärte Varianz (Residuenz {Gesamtvarianz der Daten}}$
Wie haben wir RSS und TSS definiert ?
Wie haben wir xn+1 deiniert beim Gradienten anstieg
Lernraten-Anpassung beim Gradienten-Anstieg — beide Fälle
Fall 1: f(x_{n+1}) ≥ f(x_n) ⇒ α := α · 1.2
Fall 2: f(x_{n+1}) < f(x_n) ⇒ α := α · 0.5
alpha = lernrate n
Rechenbeispiel — zwei Schritte Gradienten-Anstieg mit Lernraten-Anpassung
f(x) = -(x-3)²+5,
∇f(x) = -2·(x-3),
x0=0,
α=0.1
Schritt 1: ∇f(x0) = -2·(0-3) = 6
x1 = x0 + α·∇f(x0) = 0 + 0.1·6 = 0.6
Check: f(x1)=-0.76 ≥ f(x0)=-4 → α := 0.1·1.2 = 0.12
Schritt 2: ∇f(x1) = -2·(0.6-3) = 4.8
x2 = x1 + α·∇f(x1) = 0.6 + 0.12·4.8 = 1.176
Check: f(x2)=1.673 ≥ f(x1)=-0.76 → α := 0.12·1.2 = 0.144
Wie definieren wir die Lagrange Funktion
Wie lauten die backpropargation gleichungen?
Für was stehen die indizes j und l im Zusammenhang der BP3 Gleichung?
j bezeichnet das betrachtete Neuron einer Schicht.
ℓ bezeichnet die betrachtete Schicht (Layer) des neuronalen Netzes.
Löse Aufgabe 3
Beweise Gleichung 6.2 und 6.3
Wie haben wir den bias definiert ?
Was bedeutet Overfitting was Underfitting?
Wie haben wir Klassifikations Problem definiert?
Leiten sie die Logit fkt her (Umkehr Sigmoid)
S(t) = 1/(1+e^(-t))
Wie haben wir die Genauigkeit definiert ?
Wie haben wir die Plausibilität definiert
Berechnung von gradienten?
Wie definieren wir die logarithmische Plausabilität?
Welche Funktion gilt wenn bei Lagrange ein Extremum vorliegt ?
wie haben wir x und y Vektor in der einfachen linearen regression definiert ?
Wie haben wir die
Wie ist der Gradient einer differenzierbaren Funktion f:Rn→R definiert ?
anschaulich zeigt der Gradient in Richtung des stärksten Anstiegs der FKT.. Zur Berechnung des Maximus verwenden wir ein iteratives Verfahren
Wie haben wir die Feature Matrix X definiert?
Wie haben wir die Update-Regel des Gradientenaufstiegs definiert?
Zeige, dass für L(t) = ln(S(t)) die Ableitung L`(t) = 1-S(t) = S(-t) gilt
Wie ist die Formel des Pearson Korrelifikations Koeffizient?
Sx und Sy sind die Standardabweichungen
Wie haben wir die Covarianz definiert ?
Wie haben wird die Standardabweichung definiert?
Wie sind die Formeln für v0 und v1 (v1 wird die Ursprungsform ohne Vereinfachung gesucht)
Vereinfache Formel v1 (v1 mit korellationskoeffizient und Standardabweichungen)
Herleitung P(y|x,w)=S(y·x·w) aus P(y=+1|x,w):=S(x·w)
Zuletzt geändertvor einem Tag