๐Ÿค–๋ฐ”์ด๋ธŒ์ฝ”๋”ฉ2026-06-29

๋‰ด์Šค - ์›๋ฌธ ๊ธฐ๋ฐ˜ ์š”์•ฝ ํ•„์š”

๐Ÿ’ก ํ•œ์ค„ ์š”์•ฝ|๋‰ด์Šค - ์›๋ฌธ ๊ธฐ๋ฐ˜ ์š”์•ฝ ํ•„์š”


title: "230M ํŒŒ๋ผ๋ฏธํ„ฐ ์˜จ๋””๋ฐ”์ด์Šค AI, ์Šค๋งˆํŠธํฐ์„œ 213ํ† ํฐ/์ดˆ ๋‹ฌ์„ฑ" description: "๋‰ด์Šค - ์›๋ฌธ ๊ธฐ๋ฐ˜ ์š”์•ฝ ํ•„์š”" date: 2026-06-29 tags: [ai-news] source: "https://www.marktechpost.com/2026/06/27/liquid-ai-ships-lfm2-5-230m-with-llama-cpp-mlx-vllm-sglang-and-onnx-support-for-on-device-inference/" sidebar: order: 0

์ œ๋ชฉ(ํ•œ๊ธ€): 230M ํŒŒ๋ผ๋ฏธํ„ฐ ์˜จ๋””๋ฐ”์ด์Šค AI, ์Šค๋งˆํŠธํฐ์„œ 213ํ† ํฐ/์ดˆ ๋‹ฌ์„ฑ ์›๋ฌธ ์ œ๋ชฉ(์˜๋ฌธ): Liquid AI Ships LFM2.5-230M with llama.cpp, MLX, vLLM, SGLang, and ONNX Support for On-Device Inference ์›๋ฌธ: Liquid AI Ships LFM2.5-230M with llama.cpp, MLX, vLLM, SGLang, and ONNX Support for On-Device Inference ์†Œ์Šค: marktechpost MD ํŒŒ์ผ: content/2026-06-29/marktechpost-liquid-ai-ships-lfm2-5-230m-with-llama-cpp-mlx-vll.md

ํ•ต์‹ฌ ๋‚ด์šฉ

Liquid AI๊ฐ€ 230M ํŒŒ๋ผ๋ฏธํ„ฐ์งœ๋ฆฌ ์ดˆ์†Œํ˜• ๋ชจ๋ธ LFM2.5-230M์„ ๊ณต๊ฐœํ–ˆ์–ด์š”. ๊ฐค๋Ÿญ์‹œ S25 Ultra์—์„œ 213ํ† ํฐ/์ดˆ, ๋ผ์ฆˆ๋ฒ ๋ฆฌํŒŒ์ด 5์—์„œ๋„ 42ํ† ํฐ/์ดˆ๋กœ ๋™์ž‘ํ•˜๊ฑฐ๋“ ์š”.

๋†€๋ผ์šด ๊ฑด ํฌ๊ธฐ ๋Œ€๋น„ ์„ฑ๋Šฅ์ด์—์š”. ๋ช…๋ น์–ด ์ดํ•ด ๋ฒค์น˜๋งˆํฌ IFEval์—์„œ 71.71์ ์„ ๊ธฐ๋กํ•ด์„œ, 3~4๋ฐฐ ํฐ Qwen3.5-0.8B(59.94์ )์™€ Gemma 3 1B(63.49์ )๋ฅผ ๋ชจ๋‘ ์•ž์งˆ๋ €์–ด์š”. 19์กฐ ํ† ํฐ์œผ๋กœ ์‚ฌ์ „ ํ•™์Šตํ•˜๊ณ  ๋Œ€ํ˜• ๋ชจ๋ธ์—์„œ ์ง€์‹์„ ์ฆ๋ฅ˜(distillation)ํ•œ ๋•๋ถ„์ด์—์š”.

์šฉ๋Ÿ‰์€ 293~375MB๋กœ ์Šค๋งˆํŠธํฐยท๋กœ๋ด‡ยท์ž๋™ํ™” ๊ธฐ๊ธฐ์— ๋ฐ”๋กœ ์˜ฌ๋ฆด ์ˆ˜ ์žˆ๊ณ , llama.cppยทMLXยทvLLMยทONNX ๋“ฑ ์ฃผ์š” ์ถ”๋ก  ์—”์ง„์„ ์ฒซ๋‚ ๋ถ€ํ„ฐ ์ง€์›ํ•ด์š”. ํด๋ผ์šฐ๋“œ ์—†์ด ๊ธฐ๊ธฐ ์•ˆ์—์„œ ์—์ด์ „ํŠธ ์ž‘์—…์„ ๋Œ๋ฆฌ๋Š” ํ๋ฆ„์ด ๋ณธ๊ฒฉํ™”๋˜๊ณ  ์žˆ๋Š” ๊ฑฐ์˜ˆ์š”.

์žก๋Œ์Œค์˜ ํ•œ๋งˆ๋””

ํฌ๊ธฐ 3~4๋ฐฐ ํฐ ๊ฒฝ์Ÿ ๋ชจ๋ธ์„ ๋ช…๋ น์–ด ์ดํ•ด์—์„œ ์•ž์„  ๊ฑด ์ฒ˜์Œ์ด์—์š”. ์˜จ๋””๋ฐ”์ด์Šค AI ์—์ด์ „ํŠธ ์‹œ๋Œ€๊ฐ€ ํ˜„์‹ค๋กœ ๋‹ค๊ฐ€์˜ค๊ณ  ์žˆ์–ด์š”.


์ถœ์ฒ˜: Liquid AI Ships LFM2.5-230M with llama.cpp, MLX, vLLM, SGLang, and ONNX Support for On-Device Inference

์ด ๊ธ€์ด ์–ด๋• ๋‚˜์š”?