Den 3 juni 2026 lanserade Google ett kuraterat lokalt AI ekosystem för macOS med lekplatsen AI Edge Gallery, den encoder fria multimodala modellen Gemma 4 12B och den kostnadsfria dikteringsappen AI Edge Eloquent som... Gemma 4 12B är en tät, decoder baserad transformermodell som hanterar text, bilder, ljud och vide...

Create a landscape editorial hero image for this Studio Global article: What are the key details of Google's launch of on-device AI apps for macOS, including the AI Edge Gallery app's features, available Gemma mo. Article summary: On June 3, 2026, Google launched a trio of on-device AI products for macOS — AI Edge Gallery, the Gemma 4 12B model, and AI Edge Eloquent — forming a curated local AI ecosystem that competes directly with Ollama and LM S. Topic tags: general, documentation, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Google AI Edge Gallery launches on macOS, letting Mac users run Gemini models locally. In addition to Google AI Edge Gallery, which lets users run Gemma models locally on their M" source context "Google AI Edge Gallery launches on macOS, letting Mac users run Gemini models locally - 9to5Mac" Refe
Den 3 juni 2026 lanserade Google tre AI-produkter för lokal körning på macOS: AI Edge Gallery, modellen Gemma 4 12B och dikteringsappen AI Edge Eloquent. Tillsammans bildar de ett kuraterat ekosystem för lokal AI som direkt konkurrerar med etablerade lokala inferensplattformar som Ollama och LM Studio . Det handlar inte bara om ny mjukvara – det är ett strategiskt drag för att ta lokala AI-upplevelser till en mer polerad och konsumentvänlig nivå, om än med en tydligt kontrollerad, ”walled garden”-filosofi
.
AI Edge Gallery är en open source-app som låter Mac-användare köra Googles Gemma-modeller helt lokalt på den egna hårdvaran, med hjälp av Apple Silicon för processorkraft . Appen är tänkt som ett skyltfönster för on-device AI och erbjuder förbyggda exempel, transparenta prestandamätningar och direktlänkar till dokumentation – i praktiken en språngbräda för utvecklare
. En av de mer framträdande funktionerna är möjligheten att generera och exekvera skript direkt i appen, exempelvis för dataanalys
.
Appen finns nu tillgänglig för macOS, iOS och Android, men det är macOS-versionen som tydligast illustrerar strategin med en kuraterad modellflora . Till skillnad från de öppna biblioteken i Ollama och LM Studio, där användare kan ladda nästan vilken kompatibel modell som helst, exponerar AI Edge Gallery för macOS för närvarande fem handplockade Gemma-modeller från Google
. Enligt 9to5Mac rör det sig om Gemma-4-12B-it, Gemma-4-E2B-it, Gemma-4-E4B-it, en Gemma-4 26B-variant och FunctionGemma-270M
. Detta handplockade urval är själva kärnan i Googles strategi: en kontrollerad och kvalitetssäkrad miljö
.
Ekosystemet drivs av Googles egenutvecklade inferensmotor LiteRT-LM, som har stöd för CPU, GPU och NPU över Linux, macOS och Windows . Den modell som lyfts fram i prestandatester är Gemma-4-E2B (2,58 GB), och den officiella dokumentationen ger en tydlig bild av modellens förmåga på en MacBook Pro M4
:
Det enorma prestandalyftet med GPU-acceleration visar hur väl Googles teknikstack är anpassad för Apple Silicon och Metal-ramverket, vilket ger en närmast omedelbar och flytande användarupplevelse.
Släppt under Apache 2.0-licensen är Gemma 4 12B stjärnan i lanseringen . Arkitekturen är dess största särskiljande drag – en tät, decoder-baserad transformermodell som bygger på samma avancerade decoderstruktur som den betydligt större Gemma 4 31B Dense
.
Den avgörande innovationen är den encoder-fria multimodala arkitekturen. De flesta multimodala modeller använder separata, utrymmeskrävande kodare för bild (som en Vision Transformer) och ljud (som konformer-lager) för att översätta data till språkmodellen . Gemma 4 12B eliminerar dem helt
. Istället används:
Detta gör det möjligt för modellen att hantera text, bilder, ljud och video i ett enda enhetligt flöde . Google hävdar att arkitekturen ger ”prestanda som närmar sig vår 26B MoE-modell med mindre än hälften av minnesanvändningen”, och att den är körbar på konsumentdatorer med endast 16 GB enhetligt minne
.
Riktmärken bekräftar självförtroendet – 12B-modellen slår långt över sin viktklass. På GPQA Diamond (avancerat resonemang på forskarnivå) når den imponerande 78,8, vilket placerar den nära 26B-varianten. På akademiska flervalstest som MMLU Pro uppnår den 77,2 %, och på det tävlingsinriktade matematikprovet AIME 2026 når den 77,5 % . På LiveCodeBench för kodgenerering får den 72,5 %, vilket visar robust praktisk förmåga i agentliknande arbetsflöden och flerstegsresonemang
.
Tredje pusselbiten i trion är Google AI Edge Eloquent, en dikteringsapp som positionerar sig som ett direkt och kostnadsfritt alternativ till betalda transkriberingstjänster . Appen drivs av Gemma-baserade modeller och är designad för att fungera helt offline från grunden
.
Den överträffar enkel transkribering genom att agera som en automatisk talspråksputsare. Appen ”rensar aggressivt bort” utfyllnadsord som ”eh” och ”liksom”, korrigerar grammatik i realtid och omstrukturerar rörigt talspråk till sammanhängande, professionell text . Det gör den till mer av ett kommunikationsverktyg än en anteckningsapp. Den främsta särskiljande faktorn är prismodellen: ingen prenumeration, ingen användningsbegränsning
. macOS-versionen kräver macOS 13.0 och en Mac med åtminstone Apple M1-chip, men App Store-sidan noterar att vissa avancerade, valfria funktioner kan kräva molnanslutning
.
Den här lanseringen etablerar två motsatta filosofier för lokal AI. Googles strategi är ett ”walled garden”: ett kuraterat, Google-godkänt modellutbud, tätt integrerat med egna appar (Gallery för utforskning, Eloquent för diktering) och en enhetlig inferensmotor (LiteRT-LM) med både CLI och Python-API . Målet är att erbjuda en sömlös konsumentupplevelse som ”bara fungerar” direkt ur kartongen.
Detta står i direkt kontrast till Ollama och LM Studio, som prioriterar maximal flexibilitet och valfrihet – öppna bibliotek där användaren själv kan ladda vilken kompatibel modell som helst . Det är värt att notera att både Ollama och LM Studio redan har stöd för Gemma 4 12B-modellen med öppen vikt, så Googles modell är inte exklusiv för den egna plattformen
.
Googles fördel ligger i optimering i första part, där de egna modellerna finslipas specifikt för inferensmotorn på Apple Silicon för bättre prestanda och lägre minnesanvändning. Avvägningen för användaren är tydlig: du får en mer polerad och integrerad upplevelse, men du kan inte köra modeller utanför Googles kuraterade Gemma-familj. Detta positionerar Google för att locka användare som värdesätter tillförlitlighet och enkelhet framför experimentell frihet, och skapar en tydlig vägskälsmarkör för lokal AI på Mac.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Den 3 juni 2026 lanserade Google ett kuraterat lokalt AI ekosystem för macOS med lekplatsen AI Edge Gallery, den encoder fria multimodala modellen Gemma 4 12B och den kostnadsfria dikteringsappen AI Edge Eloquent som...
Den 3 juni 2026 lanserade Google ett kuraterat lokalt AI ekosystem för macOS med lekplatsen AI Edge Gallery, den encoder fria multimodala modellen Gemma 4 12B och den kostnadsfria dikteringsappen AI Edge Eloquent som... Gemma 4 12B är en tät, decoder baserad transformermodell som hanterar text, bilder, ljud och video utan separata kodare – och körs på bärbara datorer med endast 16 GB RAM.
Googles ”walled garden” strategi erbjuder en sömlös konsumentupplevelse med optimering i första part, men begränsar användarna till ett handplockat urval av Gemma modeller.