home.social

#visionmodell — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #visionmodell, aggregated by home.social.

  1. RT @tenhkspark: Als ich GLM5.3Flash vollständig analysiert habe, stellte ich fest, dass es neben dem Kernmodell mit 45+1 Schichten auch eine Vision-Komponente mit 24 Schichten hat. Wenn man die Bilderkennung komplett deaktiviert, wird das Modell deutlich leichter und hat genug Kapazität für einen 1M-Token-Kontextfenster. Es reicht aus, das kleine Vision-Modell zu verwenden, und wenn man auch die Vision-Komponente von DeepSeek entfernt, kann man den Kontextfenster vergrößern, ohne die Leistung zu beeinträchtigen.

    mehr auf Arint.info

    #Bilderkennung #DeepSeek #GLM5 #Kontextfenster #Modelloptimierung #VisionModell #arint_info

    https://x.com/tenhkspark/status/2105945453791785084

  2. RT @tenhkspark: Als ich GLM5.3Flash vollständig analysiert habe, stellte ich fest, dass es neben dem Kernmodell mit 45+1 Schichten auch eine Vision-Komponente mit 24 Schichten hat. Wenn man die Bilderkennung komplett deaktiviert, wird das Modell deutlich leichter und hat genug Kapazität für einen 1M-Token-Kontextfenster. Es reicht aus, das kleine Vision-Modell zu verwenden, und wenn man auch die Vision-Komponente von DeepSeek entfernt, kann man den Kontextfenster vergrößern, ohne die Leistung zu beeinträchtigen.

    mehr auf Arint.info

    #Bilderkennung #DeepSeek #GLM5 #Kontextfenster #Modelloptimierung #VisionModell #arint_info

    https://x.com/tenhkspark/status/2105945453791785084