@MyrnaGrote #1 发布于2025/10/12 01:07:02 直接调api 你都写代码了 肯定不能自建 自建那玩意 就是玩具 更何况 即使像openai anthropic 那么大硬件规模 跑出来 感觉效果都得反复修改
我试过了,情况如下: openai/gpt-oss-20b qwen/qwen3-coder-30b qwen/qwen3-30b-a3b-2507 mistralai/devstral-small-2507 这些,勉强能用比 api 调用的大模型蠢很多还慢,devstral 效果最好可惜输出多是英文。 其它模型基本处于不可用状态(太蠢了,tool 都不会好好用)。 我是 2080ti 22G + kilo code 的场景,如果显卡能更强显存更多可以试试 glm4.5-air 这个我使用大概 1.5b 的量化版本都能超越 devstral 效果可惜太太慢了。
直接调api
你都写代码了 肯定不能自建 自建那玩意 就是玩具 更何况 即使像openai anthropic 那么大硬件规模 跑出来 感觉效果都得反复修改
想尝试搞个专用模型,不知道从哪入手
有开源的,不过硬件要求不低
想搞一个玩玩
自建要想好用成本也太高了,不如直接调API
@1393668349 #4
有链接吗,得什么配置
直接调api
我试过了,情况如下:
这些,勉强能用比 api 调用的大模型蠢很多还慢,devstral 效果最好可惜输出多是英文。
其它模型基本处于不可用状态(太蠢了,tool 都不会好好用)。
我是 2080ti 22G + kilo code 的场景,如果显卡能更强显存更多可以试试 glm4.5-air 这个我使用大概 1.5b 的量化版本都能超越 devstral 效果可惜太太慢了。
还是用api省事