Warning: simplexml_load_file(): /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/themes/newsup/wpml-config.xml:12: parser error : Opening and ending tag mismatch: key line 9 and admin-texts in /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/plugins/polylang/src/modules/wpml/wpml-config.php on line 123 Warning: simplexml_load_file(): in /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/plugins/polylang/src/modules/wpml/wpml-config.php on line 123 Warning: simplexml_load_file(): ^ in /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/plugins/polylang/src/modules/wpml/wpml-config.php on line 123 Warning: simplexml_load_file(): /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/themes/newsup/wpml-config.xml:13: parser error : Opening and ending tag mismatch: key line 8 and wpml-config in /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/plugins/polylang/src/modules/wpml/wpml-config.php on line 123 Warning: simplexml_load_file(): /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/themes/newsup/wpml-config.xml:13: parser error : Premature end of data in tag key line 7 in /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/plugins/polylang/src/modules/wpml/wpml-config.php on line 123 Warning: simplexml_load_file(): /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/themes/newsup/wpml-config.xml:13: parser error : Premature end of data in tag key line 3 in /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/plugins/polylang/src/modules/wpml/wpml-config.php on line 123 Warning: simplexml_load_file(): /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/themes/newsup/wpml-config.xml:13: parser error : Premature end of data in tag admin-texts line 2 in /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/plugins/polylang/src/modules/wpml/wpml-config.php on line 123 Warning: simplexml_load_file(): /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/themes/newsup/wpml-config.xml:13: parser error : Premature end of data in tag wpml-config line 1 in /home/httpd/vhosts/ai-funghi.com/httpdocs/wp-content/plugins/polylang/src/modules/wpml/wpml-config.php on line 123 Neue Alltags-KI: Sieben Funktionen zum Ausprobieren - ai-funghi.com
  • Deutsch
  • English
  • Neue Funktionen mit Künstlicher Intelligenz (KI) lassen dein Smartphone Kleingedrucktes vorlesen, Kleidung virtuell anprobieren oder Rückmeldungen zu Videos geben. Davon profitieren Menschen mit Sehbehinderung ebenso wie Online-Kundinnen, Kreative und kleine Händler. Mehrere Angebote starten gleichzeitig, doch nicht alle sind schon allgemein verfügbar oder unabhängig geprüft.

    Was du mit Kamera und Shopping ausprobieren kannst

    Google führt mit Guided Vision eine Kamerahilfe innerhalb von Gemini Live ein. Auf kompatiblen Android-Geräten beschreibt Gemini in Echtzeit, worauf du die Kamera richtest. Die Funktion kann kleinen Text vorlesen, Gegenstände suchen oder identifizieren und Details in der Umgebung beschreiben.

    Ein konkretes Alltagsbeispiel aus der Meldung zu Guided Vision: Du suchst ein bestimmtes Produkt, lässt es von Gemini erkennen und fragst anschliessend nach dem aufgedruckten Ablaufdatum. Wenn der relevante Bereich nicht im Bild ist, soll Gemini mit gesprochenen Hinweisen helfen, die Kamera richtig auszurichten. Nachfragen beziehen sich dabei auf dasselbe Kamerabild, sodass du nicht jedes Detail neu erklären musst.

    Gedacht ist Guided Vision besonders für blinde Menschen und Personen mit eingeschränktem Sehvermögen. Die Funktion ist auch über Googles Bildschirmhilfe TalkBack sowie über einen Bedienungshilfen-Kurzbefehl auf Geräten ab Android 9 erreichbar. Google warnt allerdings ausdrücklich davor, sie zur Navigation, zur Hinderniserkennung oder als Ersatz für einen Blindenstock und andere Mobilitätshilfen zu verwenden.

    ChatGPT ergänzt seine Produktsuche derweil um eine weltweit gestartete virtuelle Anprobe. Dabei lädst du ein Selfie oder ein Ganzkörperfoto hoch und lässt dir darstellen, wie Kleidung oder Accessoires an dir aussehen könnten. Alternativ kannst du ein Produktbild oder einen Bildschirmabzug hochladen. Eine Favoritenfunktion speichert gefundene Produkte und die erzeugten Anprobebilder in der Bibliothek.

    OpenAI zufolge nutzt die Funktion das Bildmodell ChatGPT Images 2.5, das Beleuchtung und Texturen natürlicher darstellen und Bearbeitungsanweisungen zuverlässiger befolgen soll. Diese Anbieterangaben sind noch nicht unabhängig belegt. Die Darstellung ist zudem eine erzeugte Vorschau und kein verlässlicher Nachweis für Passform, Stoffwirkung oder tatsächliche Grösse.

    Was Kreative und Händler bekommen

    Ideogram 4.5 setzt an einem häufigen Problem der KI-Bildbearbeitung an: Wird nur ein Teil eines Bildes geändert, verändert das Modell manchmal unbeabsichtigt auch Gesichter, Körperformen oder Hintergründe. Das neue Modell soll laut Anbieter nicht bearbeitete Bildbereiche stabil halten. Frühe Testpersonen bestätigen dem Bericht zufolge eine hohe Konsistenz, eine umfassende unabhängige Prüfung liegt in der Quelle jedoch nicht vor.

    Das ist etwa für Produktfotos nützlich: Ein Händler könnte die Farbe eines Kleidungsstücks ändern, ohne dass sich die abgebildete Person oder der Hintergrund mitverändert. Weitere genannte Anwendungen sind Innenraumgestaltung, Fotorestaurierung und die Bearbeitung von Text in Bildern. Ideogram 4.5 arbeitet in nativer 2K-Auflösung und bietet vier Qualitätsstufen, die zwischen 0,8 und 22 Cent pro Bild kosten.

    Shopify verfolgt mit Canvas einen anderen Ansatz. Händler beschreiben im Chat, wie ihr Onlineshop aussehen soll, während der KI-Assistent Sidekick die Änderungen umsetzt. Canvas zeigt das Ergebnis laufend an, kann einzelne Bereiche vergrössern und stellt laut Shopify den tatsächlich ausführbaren Shop statt einer unbeweglichen Vorschau dar.

    Dadurch lassen sich Interaktionen, Animationen und verschiedene Bildschirmgrössen direkt prüfen. Wer lieber selbst eingreift, kann einzelne Elemente weiterhin anklicken und bearbeiten. Canvas erweitert damit Shopifys bisherigen Baukasten ohne Programmierung, bei dem tiefere Anpassungen bislang Programmcode oder externe Fachleute erfordern konnten. Die Quelle nennt für Canvas weder einen Preis noch konkrete Angaben zur regionalen Verfügbarkeit.

    Was Assistenten aus Daten und Gewohnheiten machen

    Meta integriert in seine Videobearbeitungs-App Edits einen Assistenten, der Daten aus dem eigenen Instagram-Konto auswertet. Dazu zählen Aufrufe, Wiedergabedauer, geteilte Beiträge, Likes und Kommentare. Du kannst beispielsweise fragen, weshalb ein Kurzvideo weniger Aufrufe als frühere Beiträge erhalten hat, und Vorschläge für neue Konzepte, Einstiege, Bildunterschriften, Musik oder Skripte anfordern.

    Die Auswertung in Edits vergleicht historische Leistungswerte laut Bericht auch mit aktuellen Instagram-Trends und allgemeinen Vorlieben des Publikums. Das spart Kreativen die manuelle Sichtung vieler Kennzahlen. Es bedeutet aber auch, dass die Plattform nicht nur misst, was funktioniert, sondern gleich empfiehlt, was als Nächstes produziert werden soll.

    Genau darin sieht eine zweite Einordnung ein Risiko. Wenn viele Kreative dieselben datenbasierten Empfehlungen erhalten, könnten Inhalte ähnlicher werden und stärker auf Plattformziele ausgerichtet sein. The Verge verweist zudem auf ähnliche Funktionen bei YouTube, darunter KI-gestützte Bearbeitung und A/B-Tests, bei denen verschiedene Varianten miteinander verglichen werden.

    Google wiederum führt weltweit Skills in Gemini ein. Ein Skill ist eine gespeicherte, detaillierte Arbeitsanweisung für wiederkehrende Aufgaben. Du kannst ihn mit einem Schrägstrich und seinem Namen aufrufen, aus bisherigen Unterhaltungen erstellen lassen oder von Gemini bei passenden Eingaben automatisch ausführen lassen.

    Skills können Textdokumente, Portable-Document-Format-Dateien (PDF) und Bilder als Referenzen enthalten. Mehrere Skills lassen sich laut Google kombinieren, etwa einer für den Schreibstil und einer für Markenrichtlinien. Sie ersetzen schrittweise Googles bisherige Gems; bestehende Gems werden automatisch umgewandelt. Funktionen zum Teilen sowie Verknüpfungen mit Google Drive und Gemini Notebook sollen erst später folgen.

    Am experimentellsten ist Griffin von Tavus. Das sogenannte Human Interaction Model, also ein Modell für menschlich wirkende Interaktion, soll Sprache, Mimik, Tonfall, Gesten und Pausen in Videogesprächen verarbeiten. Tavus nennt Nachhilfe, das Üben schwieriger Gespräche und technische Unterstützung per Kamera als mögliche Anwendungen.

    In einer Studie des Anbieters hielten 48 Prozent der Teilnehmenden Griffin nach einem einminütigen Gespräch für einen Menschen; frühere Systeme hätten höchstens zwei Prozent erreicht. Ein laut Tavus unabhängiger Test von Nvidia vergab 3,83 Punkte für die menschliche Wirkung, gegenüber 3,92 für Menschen und 2,80 für das zuvor beste KI-Modell. Diese Werte stammen aus Anbieterinformationen und sind anhand der gelieferten Quellen nicht unabhängig überprüfbar; zudem ist Griffin-Lite erst für ausgewählte Testpersonen verfügbar.

    Pro und Kontra der neuen Alltags-KI

    Pro:

    • Konkrete Hilfe – Guided Vision kann kleinen Text und Gegenstände zugänglicher machen, solange du es nicht als Sicherheitssystem verwendest.
    • Schnellere Entwürfe – Virtuelle Anproben, stabile Bildänderungen und der Shop-Bau per Chat verkürzen den Weg von einer Idee zu einer sichtbaren Variante.
    • Einfachere Auswertung – Der Edits-Assistent übersetzt zahlreiche Leistungskennzahlen in verständliche Antworten und Vorschläge.
    • Wiederverwendbare Abläufe – Gemini Skills speichern häufig benötigte Anweisungen, statt dass du sie bei jeder Aufgabe neu formulierst.

    Kontra:

    • Fehler mit Folgen – Kamerabeschreibungen, Bildvorschauen und Gesprächsassistenten können überzeugend wirken, obwohl ihre Aussage falsch ist.
    • Sensible Daten – Selfies, Ganzkörperbilder, Kamerabilder, Kontodaten und Gesprächsvideos können persönliche Informationen enthalten.
    • Plattformabhängigkeit – Empfehlungen von Instagram oder Shop-Aufbauten von Shopify orientieren sich an den Regeln und Interessen des jeweiligen Anbieters.
    • Unklare Verfügbarkeit – Einige Funktionen starten nur auf kompatiblen Geräten oder für ausgewählte Testpersonen; für mehrere Angebote fehlen Preis- und Länderangaben.

    Was das für deine Praxis und die Schweiz heisst

    Für Einsteigerinnen und Einsteiger: Beginne mit einer Aufgabe, deren Ergebnis du selbst leicht prüfen kannst. Lass Guided Vision beispielsweise eine gut sichtbare Verpackungsaufschrift vorlesen, teste eine virtuelle Anprobe mit einem unkritischen Foto oder ändere in Ideogram nur die Farbe eines Gegenstands. Vergleiche das Resultat anschliessend mit dem Original und lade keine Aufnahme hoch, die private Dokumente oder andere Personen zeigt.

    Für Fortgeschrittene: Mehr Nutzen entsteht durch wiederholbare Aufgaben und kontrollierte Vergleiche. Du kannst in Gemini einen Skill für regelmässige Textarbeiten speichern, mehrere Bildbearbeitungen auf unbeabsichtigte Veränderungen prüfen oder die Vorschläge des Edits-Assistenten mit den ursprünglichen Kontokennzahlen vergleichen. Bei einem Shop solltest du neben dem Aussehen auch Interaktionen, Animationen und die Darstellung auf verschiedenen Bildschirmgrössen testen.

    Für Nutzerinnen und Nutzer in der Schweiz bleiben einige praktische Fragen offen. ChatGPT bezeichnet die virtuelle Anprobe als globalen Start, während die Quellen bei Guided Vision, Canvas, Edits und Ideogram keine eindeutigen Angaben zur Verfügbarkeit in der Schweiz machen. Auch zur Qualität in Deutsch, zu Schweizer Sprachvarianten und zum Speicherort hochgeladener Bilder oder Videos enthalten die Meldungen keine belastbaren Details.

    Das ist besonders relevant, wenn du Kundendaten, Kontoanalysen, Fotos von Mitarbeitenden oder Unterrichtsmaterial verwendest. Die Quellen liefern keine ausreichende Grundlage für eine datenschutzrechtliche Bewertung. Für Schulen, Unternehmen und Organisationen kommt hinzu, dass Gemini Skills für Workspace-Konten aus Bildung, Unternehmen und gemeinnützigen Organisationen erst in den kommenden Wochen starten sollen.

    Die neuen Funktionen machen KI greifbarer, weil sie nicht nur Texte erzeugen, sondern sehen, gestalten, auswerten und in Videogesprächen reagieren. Am überzeugendsten sind klar begrenzte Aufgaben, deren Resultat du überprüfen kannst; schwächer wird die Bilanz bei Sicherheit, sensiblen Aufnahmen und nicht belegten Anbieterwerten. Das offene Risiko ist weniger ein einzelner spektakulärer Fehler als das schleichende Vertrauen in Vorschläge, Bilder und Kennzahlen, die plausibel aussehen, aber nicht zwingend stimmen.

    Quellen

    AI-FunghiAI-Funghi

    Bild: Ron Lach via Pexels

    © 2024 - 2026 ai-funghi.com | All Rights Reserved | Impressum | Datenschutz