← Zurück zu Tags

Tag

#llama.cpp

8 Artikel

Modell-News

Meta Muse Glimmer 30B im Faktencheck: lokales Agentenmodell für 24/32 GB

Muse Glimmer 30B geprüft: 24/32-GB-Hardware, DFlash-Speed, 131K Kontext, Ollama/MLX und Benchmarks gegen Qwen3.6-27B – mit Methodikcheck.

Model News

Meta Muse Glimmer 30B fact-checked: 24/32 GB, DFlash, Qwen3.6-27B

Muse Glimmer 30B checked: 24/32 GB hardware, DFlash speed, 131K context, Ollama/MLX and independent benchmarks against Qwen3.6-27B.

Modell-News

NVIDIA Nemotron 3.5 Lightning: 30B-Agentenmodell, 1M Kontext, RTX & Mac

Faktencheck zu NVIDIA Nemotron 3.5 Lightning: 30B/3B-Architektur, 1M Modellmaximum, unabhängige Benchmarks, API-Preise und lokale Nutzung.

Model News

NVIDIA Nemotron 3.5 Lightning: 30B agent model, 1M context, RTX & Mac

Verified guide to NVIDIA Nemotron 3.5 Lightning: 30B/3B architecture, 1M maximum, independent benchmarks, API pricing and local runs.

Lokale Modelle

Qwen3.6-27B Fable Fusion 711 auf dem Mac: GGUF-Größen und RAM-Wahl

Welche Fable-Fusion-711-GGUF passt zu 24, 32, 48 oder 64 GB Unified Memory? Größen, MTP, Vision und Benchmark-Evidenz – ohne eigene Mac-Benchmarks.

Local Models

Qwen3.6-27B Fable Fusion 711 on Mac: GGUF Sizes and RAM Choices

Which Fable Fusion 711 GGUF fits 24, 32, 48 or 64 GB of unified memory? File sizes, MTP, vision and benchmark evidence—without claiming original Mac benchmarks.

Hardware

Wie viel RAM braucht ein lokales LLM auf dem Mac?

Wie viel Unified Memory lokale LLMs auf Apple-Silicon-Macs wirklich brauchen – mit Formeln, KV-Cache-Rechnungen und Kaufberatung von 8 bis 512 GB.

Hardware

How Much RAM Does a Local LLM Need on a Mac?

A practical guide to unified memory for local LLMs on Apple silicon, including weight math, KV-cache examples, Mac tiers and buying advice.