In einem Praxistest wurden Google Gemini 3.6 Flash und OpenAI GPT-5.6 Sol verglichen, indem beide KI-Modelle Zugriff auf das digitale Leben eines Nutzers erhielten. Die Angaben beinhalteten Kalendereinträge, Nachrichten, Belege, Fotos und Notizen. Während Gemini die verfügbaren Informationen hauptsächlich zusammenfasste, zeigte GPT eine stärkere Fähigkeit für Schlussfolgerungen. Es identifizierte Konflikte, berechnete Ausgaben, interpretierte Notizen und erstellte einen praktischen Wochenplan.
Der hier durchgeführte Test verdeutlichte einen wesentlichen Unterschied. Gemini lieferte verdichtete Informationen, während GPT-5.6 aus den Daten konkrete Handlungsempfehlungen ableitete. Der Vergleich deutet darauf hin, dass zukünftige KI-Assistenten weniger anhand von Benchmarks als vielmehr anhand ihrer Fähigkeit beurteilt werden, konkrete Probleme effektiv zu lösen.