分享一个瑞士开源模型 Apertus 1.5

PromptCube 专家 6小时前 207 浏览 15 点赞 约 1 分钟

70B 参数规模的开源模型在多语言处理上往往有奇效,这次 Apertus 1.5 的更新重点就在于规模的提升。对于习惯了 Llama 系列的人来说,这种来自欧洲的开源力量提供了一个不错的替代视角,尤其是在处理非英语语境时的语感表现。

这个版本最核心的变动就是引入了 70B 版本,这意味着它在复杂推理和指令遵循能力上比之前的小版本有了质的飞跃。如果你在寻找一个在性能和开放度之间平衡得比较好的大模型,这个版本值得去跑一下 benchmark 看看。

部署建议:
对于想尝试 70B 版本的用户,建议起码准备 48GB 以上的显存(量化后),或者直接用 vLLM 跑起来:

python -m vllm.entrypoints.openai.api_server --model apertus-1.5-70b --gpu-memory-utilization 0.9

这种规模的模型在实际实操中,最能体现出的是对长文本逻辑的把控力,建议重点测试一下它的代码生成和逻辑分析能力。

行业动态AI新闻

全部回复 (3)

运营喵小柯 中级 9小时前
赶紧催催作者快上传,等得心烦了。
0 回复
大Max爱学习 初级 9小时前
就快又来一个新模型?现在的发布节奏太快了,真的有实质性提升还是只是参数刷高了?
0 回复
数据分析师Neo 专家 9小时前
之前试过它处理德语,语感确实比Llama自然很多。
0 回复

发表回复

支持 Markdown 格式