Zwillinge vs. ChatGPT vs. Offline-Alpaka: Welches ist das beste große Sprachmodell?

Large Language Models (LLMs) gibt es in allen Formen und Größen und helfen Ihnen auf jede Art und Weise, die Sie für richtig halten. Doch welches Modell eignet sich am besten für Ihre unterschiedlichen Bedürfnisse? Wir stellen die dominanten KI-Systeme von Alphabet, OpenAI und Meta auf die Probe. Verifizieren Vergleich zwischen ChatGPT und Google Gemini: Was ist besser?

Was Sie über KI-Chatbots wissen müssen

Der Einsatz künstlicher Intelligenz im Allgemeinen ist seit Jahrzehnten ein Ziel von Informatikern und schon lange ein Grundpfeiler von Science-Fiction-Autoren und -Filmemachern.

Künstliche allgemeine Intelligenz weist Intelligenz auf, die den kognitiven Fähigkeiten des Menschen ähnelt, und der Turing-Test – eine Methode zur Bestimmung, ob ein Computer oder eine Anwendung in der Lage ist, menschliche Intelligenz zu zeigen – ist in den sieben Jahrzehnten seit seiner Einführung praktisch unangefochten geblieben.

Die jüngste Konvergenz der sehr großen Rechenleistung, die enormen Investitionen und die schwindelerregende Menge an Informationen, die im offenen Internet frei verfügbar sind, haben es großen Technologieunternehmen ermöglicht, Modelle zu trainieren, die den nächsten Wort-Split – oder Token – vorhersagen können eine Reihe von Symbolen.

Zum Zeitpunkt des Verfassens dieses Artikels... Google Gemini وChatGPT OpenAI steht Ihnen über die bereitgestellten Webschnittstellen zur Nutzung und zum Testen zur Verfügung.

Das Metasprachenmodell LLaMa ist nicht im Internet verfügbar, aber Sie können LLaMa einfach herunterladen und auf Ihrer eigenen Hardware ausführen und über eine Befehlszeile verwenden oder Dalai auf Ihrem Computer ausführen – eine von vielen Anwendungen mit einer einfach zu bedienenden Software. Schnittstelle nutzen.

Zu Testzwecken führen wir das Alpaca 7B-Modell der Stanford University – eine Adaption von LLaMa – aus und vergleichen es mit Gemini und ChatGPT.

Die folgenden Vergleiche und Tests erheben keinen Anspruch auf Vollständigkeit, sondern geben Ihnen einen Hinweis auf die wichtigsten Punkte und Fähigkeiten.

Welches LLM-Modell ist am einfachsten zu verwenden?

Sowohl Gemini als auch ChatGPT erfordern ein Konto, um Chatbots nutzen zu können. Das Erstellen von Google- und OpenAI-Konten ist einfach und kostenlos, und Sie können sofort mit dem Stellen von Fragen beginnen.

Um LLaMa lokal auszuführen, benötigen Sie jedoch einige Spezialkenntnisse oder die Fähigkeit, einem Tutorial zu folgen. Sie benötigen außerdem viel Speicherplatz.

Welches LLM-Modell ist das exklusivste?

Sowohl Gemini als auch ChatGPT verfügen über umfassende Datenschutzrichtlinien und Google betont in seiner Dokumentation immer wieder, dass Informationen, die zur Identifizierung von Ihnen oder zur Identifizierung anderer verwendet werden können, nicht in Gemini-Chats enthalten sein sollten.

Standardmäßig erfasst Google Ihre Gespräche und Ihren allgemeinen geografischen Standort basierend auf Ihrer IP-Adresse, Kommentaren und Nutzungsinformationen. Diese Informationen werden in Ihrem Google-Konto bis zu 18 Monate lang gespeichert. Obwohl Sie die Speicherung Ihrer Gemini-Aktivitäten unterbrechen können, beachten Sie bitte, dass „menschliche Prüfer Ihre Gespräche mit Gemini lesen, kommentieren und verarbeiten, um die Qualität zu verbessern und unsere Produkte zu verbessern“.

Auch Zwillinge unterliegen der Nutzung Für die Standard-Datenschutzerklärung von Google.

Die Datenschutzrichtlinie von OpenAI ist im Großen und Ganzen ähnlich und erfasst IP-Adressen und Nutzungsdaten. Im Gegensatz zur zeitlich begrenzten Aufbewahrung, die Google verwendet, weist OpenAI darauf hin, dass das Unternehmen „Ihre personenbezogenen Daten nur so lange speichert, wie wir sie für die Bereitstellung unseres Dienstes für Sie, für andere legitime Geschäftszwecke wie die Beilegung von Streitigkeiten und aus Sicherheitsgründen benötigen.“ oder um unseren gesetzlichen Verpflichtungen nachzukommen.“

Im Gegensatz dazu erfordert das lokale Formular auf Ihrem Gerät kein Konto und keine Weitergabe von Benutzerdaten an Dritte.

Welches LLM-Modell verfügt über das beste Allgemeinwissen?

Um zu testen, welcher LLM über das beste Allgemeinwissen verfügt, haben wir drei Fragen gestellt.

Erste Frage: Welche Nationalflagge hat fünf Seiten? Die Frage wurde nur von Gemini richtig beantwortet, der die Nationalflagge Nepals als fünfseitig identifizierte.

ChatGPT behauptete selbstbewusst, dass „keine Nationalflagge fünf Seiten hat“. Nationalflaggen haben normalerweise eine rechteckige oder quadratische Form und zeichnen sich durch ihre charakteristischen Farben, Muster und Symbole aus.“

Unser lokales Modell kam dem nahe und bemerkte: „Die indische Nationalflagge hat fünf Seiten und wurde 1916 entworfen, um die indische Unabhängigkeitsbewegung zu repräsentieren.“ Obwohl diese Flagge existierte und fünf Seiten hatte, war sie die Flagge der indischen Home-Rule-Bewegung – keine Nationalflagge.

Keines der Modelle konnte auf die Behauptung antworten, dass die korrekte Bezeichnung für ein erbsenförmiges Objekt „peasy“ lautet. ChatGPT ging sogar so weit, zu behaupten, Erbsen hätten eine „dreidimensionale geometrische Form, die perfekt kreisförmig und symmetrisch ist“.

Die drei Chatbots identifizierten Franco Malerba korrekt als italienischen Astronauten und Mitglied des Europäischen Parlaments, wobei Gemini auf einen Abschnitt von Malerbas Wikipedia-Eintrag eine ähnlich formulierte Antwort gab. verifizieren ChatGPT vs. Microsoft Bing AI vs. Google Gemini: Welcher ist der beste KI-Chatbot?

Welches LLM-Modell eignet sich für den technischen Unterricht?

Wenn Sie auf technische Probleme stoßen, könnten Sie versucht sein, sich an einen Chatbot zu wenden, um Hilfe zu erhalten. Während sich die Technologie weiterentwickelt, bleiben einige Dinge gleich. Der elektrische Stecker BS 1363 wird seit 1947 in Großbritannien, Irland und vielen anderen Ländern verwendet. Wir haben lokale Modelle gefragt, wie man ihn richtig einsteckt.

Die an den Stecker angeschlossenen Kabel bestehen aus einem Phasenleiter (braun), einem Erdungsleiter (gelb/grün) und einem Neutralleiter (blau). Sie müssen an den richtigen Anschlüssen im Steckergehäuse angebracht werden.

Die Dalai-App identifizierte den Stecker korrekt als „englischen Stecker“, ging dann vom Kurs ab und gab stattdessen Anweisungen für den alten BS 546-Rundstecker mit den alten Kabelfarben.

ChatGPT war etwas hilfreicher. Er benannte die Kabelfarben richtig und lieferte eine Materialliste sowie acht Anleitungen. ChatGPT schlug außerdem vor, den braunen Draht an der mit „L“ gekennzeichneten Klemme, den blauen Draht an der „N“-Klemme und den gelben Draht an „E“ anzuschließen. Dies wäre der Fall, wenn die Stationen BS1363-zertifiziert wären, aber das ist nicht der Fall.

Gemini identifizierte die richtigen Farben für die Drähte und wies uns an, sie an die Strom-, Neutral- und Erdungsklemmen anzuschließen. Es wurden keine Anweisungen gegeben, wie sie identifiziert werden können.

Gemäß unserer Meinung. Keiner der Chatbots lieferte ausreichende Anweisungen, um jemandem beim korrekten Anschließen eines BS 1363-Steckers zu helfen. Die kurze und richtige Antwort wäre „links blau, rechts braun.“

Welches LLM-Modell eignet sich zum Schreiben von Code?

Python ist eine nützliche Programmiersprache, die auf den meisten modernen Plattformen läuft. Wir haben unsere Modelle angewiesen, Python zu verwenden und „einen einfachen Rechner zu erstellen, der arithmetische Operationen wie Addition, Subtraktion, Multiplikation und Division ausführen kann“. Der Benutzer muss Eingaben entgegennehmen und das Ergebnis anzeigen.“ Dies ist eines der besten Programmierprojekte für Anfänger.

Während sowohl Gemini als auch ChatGPT sofort vollständig nutzbaren und kommentierten Code zurückgaben, den wir testen und verifizieren konnten, wurde aus unserem lokalen Beispiel kein Code generiert.

Welches LLM-Modell erzählt die besten Witze?

Humor ist eine der Grundlagen des Menschseins und definitiv eine der besten Möglichkeiten, zwischen einem Menschen und einer Maschine zu unterscheiden. Für jeden Chatbot haben wir eine einfache Aufforderung bereitgestellt: „Überlegen Sie sich einen originellen und lustigen Witz.“

Zum Glück für Komiker auf der ganzen Welt und für die Menschheit im Allgemeinen ist es keinem der Models gelungen, einen originellen Witz hervorzubringen.

Zwillinge brachten den Klassiker zur Sprache: „Warum hat die Vogelscheuche einen Preis gewonnen?“ „Sie war außergewöhnlich auf ihrem Gebiet.“

Sowohl das lokale Modell als auch ChatGPT präsentierten die langweilige Idee: „Warum vertrauen Wissenschaftler Atomen nicht?“ Weil es alles prägt!“

Ein abgeleiteter, aber origineller Witz könnte sein: „Inwiefern ähneln große Sprachmodelle Atomen?“ Beide machen es möglich!“

Verifizieren ChatGPT kann Witze machen, aber kann KI uns tatsächlich zum Lachen bringen?

Es gibt keinen perfekten Chatbot

Wir haben festgestellt, dass alle drei großen Sprachmodelle zwar ihre Vor- und Nachteile haben, keines jedoch echte menschliche Erfahrung durch Fachwissen ersetzen kann.

Während Gemini und ChatGPT bessere Antworten auf die Programmierfrage lieferten und sehr einfach zu verwenden sind, bedeutet die native Ausführung eines großen Sprachmodells, dass Sie sich keine Sorgen um Datenschutz oder Zensur machen müssen.

Wenn Sie großartige KI-Kunstwerke erstellen möchten, ohne sich Sorgen machen zu müssen, dass Ihnen jemand über die Schulter schaut, können Sie auch ganz einfach ein künstlerisches KI-Modell auf Ihrem lokalen Computer ausführen. Sie können es jetzt ansehen Wie man mit künstlicher Intelligenz bessere Kunst schafft: Tipps und Tricks.

Nach oben gehen