Французский стартап ZML выпустил бесплатный inference-сервер LLMD — работает на Nvidia, AMD, Google

AI | Новости | Volodymyr Saakian

AI | Новости | Volodymyr Saakian

@ai_it_education

🤖 AI новости для разработчиков, фрилансеров и бизнеса Tech Lead @ TUI · 9 лет в IT 90% моего кода пишет AI — рассказываю как и зачем Кейсы · Инструменты · Автоматизация Вопросы → @llossless

Французский стартап ZML выпустил бесплатный inference-сервер LLMD — работает на Nvidia, AMD, Google TPU, Apple Metal и Intel одновременно 🔥 Никакой привязки к одному вендору: одна инсталляция, любой чип.

Поддерживает LLaMA, Gemma, Qwen и Mistral с continuous batching и prefix caching. Сам продукт бесплатный, хотя стартап уже поднял $20M от 20VC и LocalGlobe. Сначала хотят понять, как его используют — потом решать про монетизацию.

Война за AI-инфраструктуру идёт не только на уровне моделей, но и на уровне железа 🏗️

#AI #inference #opensource
1 صورة مرفق بهذا المنشور — مرئي في تطبيق تيليجرام.
فتح المنشور في تيليجرام