Apple KI-Forscher haben eine bahnbrechende Methode entwickelt, um große Sprachmodelle (LLMs) auf iPhones und anderen Apple-Geräten mit begrenztem Speicher auszuführen. Sie haben eine innovative Technik zur Nutzung des Flash-Speichers erfunden, um die Speicherbeschränkungen von LLM-basierten Chatbots zu überwinden. Bei dieser Technik werden die Daten des KI-Modells im Flash-Speicher gespeichert, der in mobilen Geräten häufiger vorhanden ist als herkömmlicher RAM. Die Forscher verwenden zwei Schlüsseltechniken, Windowing und Zeilen-Spalten-Bündelung, um den Datentransfer zu minimieren und den Flash-Speicher-Durchsatz zu maximieren. Dadurch können KI-Modelle bis zur doppelten Größe des verfügbaren Speichers des iPhones ausgeführt werden, was zu deutlich schnelleren Verarbeitungsgeschwindigkeiten führt. Der Durchbruch eröffnet Möglichkeiten für erweiterte Siri-Funktionen, Echtzeit-Sprachübersetzung und KI-gesteuerte Funktionen in der Fotografie und Augmented Reality auf zukünftigen iPhones. Apple entwickelt auch sein eigenes generatives KI-Modell namens Ajax, um mit OpenAIs GPT-3 und GPT-4 zu konkurrieren. Ajax arbeitet mit 200 Milliarden Parametern und zielt darauf ab, die KI tiefer in das Apple-Ökosystem zu integrieren. Es wird erwartet, dass Apple bis Ende 2024 eine Kombination aus Cloud-basierter KI und geräteinterner Verarbeitung für generative KI-Funktionen auf dem iPhone und iPad anbieten wird.
