DeepFloodbeta

部署一个翻译类的AI模型大概需要什么配置

RT

  • 需要14~30B规模的模型才有比较好的翻译效果。

    如果支持原生FP8算子(4090+, Hopper系列以后),或者是Amper系列或者是3090,大约需要24~40G显存。

    如果是更老的卡,则需要FP16,在上述显存条件上翻倍。