πŸ› οΈAI 도ꡬ2026-07-10

λ‰΄μŠ€ - 원문 기반 μš”μ•½ ν•„μš”

πŸ’‘ ν•œμ€„ μš”μ•½|λ‰΄μŠ€ - 원문 기반 μš”μ•½ ν•„μš”


title: "NVIDIA, 75B μ••μΆ• MoE λͺ¨λΈλ‘œ μ„œλ²„ μ²˜λ¦¬λŸ‰ 2λ°° 달성" description: "λ‰΄μŠ€ - 원문 기반 μš”μ•½ ν•„μš”" date: 2026-07-10 tags: [ai-news] source: "https://www.marktechpost.com/2026/07/09/meet-nemotron-labs-3-puzzle-75b-a9b/" sidebar: order: 0

제λͺ©(ν•œκΈ€): NVIDIA, 75B μ••μΆ• MoE λͺ¨λΈλ‘œ μ„œλ²„ μ²˜λ¦¬λŸ‰ 2λ°° 달성 원문 제λͺ©(영문): Meet Nemotron Labs 3 Puzzle 75B A9B: A Compressed Hybrid MoE LLM Delivering 2.03x Server Throughput 원문: Meet Nemotron Labs 3 Puzzle 75B A9B: A Compressed Hybrid MoE LLM Delivering 2.03x Server Throughput μ†ŒμŠ€: marktechpost MD 파일: content/2026-07-10/marktechpost-meet-nemotron-labs-3-puzzle-75b-a9b-a-compressed-h.md

핡심 λ‚΄μš©

NVIDIA AIνŒ€μ΄ Nemotron-3-Superλ₯Ό μ••μΆ•ν•œ Puzzle-75B-A9Bλ₯Ό κ³΅κ°œν–ˆμ–΄μš”. 120.7B νŒŒλΌλ―Έν„°λ₯Ό 75.3B으둜, ν™œμ„± νŒŒλΌλ―Έν„°λŠ” 12.8Bμ—μ„œ 9.3B으둜 μ€„μ˜€λŠ”λ°λ„ μ„±λŠ₯은 거의 κ·ΈλŒ€λ‘œμ˜ˆμš”.

핡심 μ„±κ³ΌλŠ” μ²˜λ¦¬λŸ‰μ΄μ—μš”. 8xB200 μ„œλ²„ κΈ°μ€€ μ΅œλŒ€ 2.14λ°° μ²˜λ¦¬λŸ‰ ν–₯상을 λ‹¬μ„±ν–ˆκ³ , H100 단일 μ„œλ²„μ—μ„œ 100만 ν† ν°μ§œλ¦¬ μš”μ²­μ„ 1κ°œμ—μ„œ 8κ°œκΉŒμ§€ λ™μ‹œ μ²˜λ¦¬ν•  수 있게 λκ±°λ“ μš”. λͺ¨λΈ κ°€μ€‘μΉ˜κ°€ 70GBμ—μ„œ 44.5GB둜 쀄어든 λ•λΆ„μ΄μ—μš”.

λŒ€ν˜• AI λͺ¨λΈμ„ μ‹€μ œ μ„œλΉ„μŠ€μ— 올릴 λ•Œ κ°€μž₯ 큰 μž₯벽이 'λΉ„μš© λŒ€λΉ„ 처리 μš©λŸ‰'인데, 정확도 손싀 없이 μ„œλ²„ νš¨μœ¨μ„ 2배둜 λŒμ–΄μ˜¬λ¦° μ••μΆ• 방식이 μ£Όλͺ©λ°›κ³  μžˆμ–΄μš”.

작돌쌀의 ν•œλ§ˆλ””

AI μ„œλΉ„μŠ€ λΉ„μš©μ˜ 핡심은 GPU λͺ‡ λŒ€λ‘œ λͺ‡ λͺ…을 λ™μ‹œμ— μ²˜λ¦¬ν•˜λŠλƒμ˜ˆμš”. μ²˜λ¦¬λŸ‰ 2λ°°λŠ” κ³§ μ„œλ²„ λΉ„μš© μ ˆλ°˜μ„ μ˜λ―Έν•˜κ±°λ“ μš”.


좜처: Meet Nemotron Labs 3 Puzzle 75B A9B: A Compressed Hybrid MoE LLM Delivering 2.03x Server Throughput

이 글이 μ–΄λ• λ‚˜μš”?