#modelloptimierung — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #modelloptimierung, aggregated by home.social.
-
RT @tenhkspark: Als ich GLM5.3Flash vollständig analysiert habe, stellte ich fest, dass es neben dem Kernmodell mit 45+1 Schichten auch eine Vision-Komponente mit 24 Schichten hat. Wenn man die Bilderkennung komplett deaktiviert, wird das Modell deutlich leichter und hat genug Kapazität für einen 1M-Token-Kontextfenster. Es reicht aus, das kleine Vision-Modell zu verwenden, und wenn man auch die Vision-Komponente von DeepSeek entfernt, kann man den Kontextfenster vergrößern, ohne die Leistung zu beeinträchtigen.
mehr auf Arint.info
#Bilderkennung #DeepSeek #GLM5 #Kontextfenster #Modelloptimierung #VisionModell #arint_info
-
RT @tenhkspark: Als ich GLM5.3Flash vollständig analysiert habe, stellte ich fest, dass es neben dem Kernmodell mit 45+1 Schichten auch eine Vision-Komponente mit 24 Schichten hat. Wenn man die Bilderkennung komplett deaktiviert, wird das Modell deutlich leichter und hat genug Kapazität für einen 1M-Token-Kontextfenster. Es reicht aus, das kleine Vision-Modell zu verwenden, und wenn man auch die Vision-Komponente von DeepSeek entfernt, kann man den Kontextfenster vergrößern, ohne die Leistung zu beeinträchtigen.
mehr auf Arint.info
#Bilderkennung #DeepSeek #GLM5 #Kontextfenster #Modelloptimierung #VisionModell #arint_info