News
OpenAI präsentiert o3-mini: Ein neues Kapitel in der KI-Effizienz und Leistungsfähigkeit
OpenAIs neues Modell o3-mini: Effizienz trifft auf Leistungsfähigkeit
OpenAI hat eine schlankere, effizientere Version seines fortschrittlichsten KI-Modells kostenlos veröffentlicht. o3-mini, wie das Modell heißt, soll eine Antwort auf den Hype um das Open-Source-Angebot R1 des chinesischen KI-Startups DeepSeek sein. Wie WIRED bereits berichtete, arbeitete OpenAI intensiv an der Fertigstellung von o3-mini für den Launch.
o3-mini ist eine kleinere Version des großen Sprachmodells von OpenAI, die jedoch die fortschrittlichsten KI-Argumentationsfähigkeiten aller bisherigen OpenAI-Angebote bietet. Das Modell kann komplexe Probleme in ihre Bestandteile zerlegen, um den besten Lösungsweg zu finden. "Dieses leistungsstarke und schnelle Modell erweitert die Grenzen dessen, was kleine Modelle leisten können", so das Unternehmen in einem Blogbeitrag zur Veröffentlichung von o3-mini.
Zugänglich ist o3-mini für alle Plus-, Team- und Pro-Nutzer von ChatGPT. Auch Nutzer der kostenlosen Version von ChatGPT können o3-mini testen, allerdings mit eingeschränkter Anfragekapazität.
Offenbar setzt OpenAI bereits seit einiger Zeit Doktoranden für das Training neuer Modelle ein. Vor einigen Wochen begann das Unternehmen, Informatik-Doktoranden für eine "Forschungszusammenarbeit" mit einem Stundensatz von 100 US-Dollar zu rekrutieren. Diese Zusammenarbeit sollte laut einer von WIRED eingesehenen E-Mail die Arbeit an unveröffentlichten Modellen umfassen.
Zusätzlich scheint OpenAI über die Firma Mercor, die regelmäßig für die Rekrutierung von Mitarbeitern für das Modelltraining eingesetzt wird, Doktoranden mit Expertise in anderen Bereichen angeworben zu haben. Eine kürzlich von Mercor auf LinkedIn veröffentlichte Stellenanzeige beschreibt das Ziel des Projekts: "Die Erstellung anspruchsvoller wissenschaftlicher Programmierfragen, die darauf abzielen, die Fähigkeiten großer Sprachmodelle bei der Generierung von Code zur Lösung realistischer wissenschaftlicher Forschungsprobleme zu testen."
Die in der Stellenanzeige aufgeführte Beispielaufgabe ähnelt stark einer Aufgabe aus dem Benchmark SciCode, der die Fähigkeit großer Sprachmodelle zur Lösung komplexer wissenschaftlicher Probleme bewertet.
Die Veröffentlichung von o3-mini erfolgt inmitten der anhaltenden Diskussionen um DeepSeeks R1, das die US-Tech-Industrie in Aufruhr versetzt. Die kostenlose Verfügbarkeit eines so leistungsstarken Modells erhöht den Druck auf Google und Anthropic, ihre Preise zu senken. Laut Insidern ist OpenAI besonders daran interessiert zu demonstrieren, dass es bei der Entwicklung und Kommerzialisierung von KI weiterhin führend ist.
DeepSeeks frei verfügbares Modell enthält Innovationen, die sowohl das Training als auch die Bereitstellung effizienter machen. Das Unternehmen scheint das Modell mit deutlich weniger Ressourcen entwickelt zu haben als OpenAI und andere US-Unternehmen, die derzeit an hochmodernen KI-Modellen arbeiten, obwohl die genauen Ausgaben von DeepSeek unbekannt sind. OpenAI vermutet, dass R1 möglicherweise die Ausgabe seiner eigenen Modelle in das Training integriert hat.
OpenAIs neuestes Modell mag R1 preislich nicht übertreffen, zeigt aber, dass das Unternehmen künftig verstärkt auf Effizienz setzen wird. OpenAI betont außerdem die besondere Stärke des Modells in Mathematik, Naturwissenschaften und Programmierung.
Zu den neuen Funktionen des Modells gehören laut OpenAI die Möglichkeit, Websuchen durchzuführen, Funktionen aus dem Code eines Benutzers aufzurufen und zwischen verschiedenen Argumentationsstufen zu wechseln, die Geschwindigkeit gegen Problemlösungsfähigkeiten abwägen.
Der plötzliche Aufstieg von DeepSeek wirft auch Fragen zur Strategie der US-Regierung auf, Chinas Aufstieg im Bereich der KI einzudämmen. Die letzten beiden US-Regierungen haben eine Reihe von Sanktionen eingeführt, um Chinas Zugang zu den fortschrittlichsten Nvidia-Chips zu beschränken, die typischerweise für den Aufbau modernster KI-Modelle verwendet werden. DeepSeek erwähnte in seiner Forschung mehrere Arten von Nvidia-Chips, aber es bleibt unklar, welche genau verwendet wurden.
Bibliographie: https://www.wired.com/story/openai-o3-mini-release/ https://www.wired.com/story/openai-deepseek-stargate-sam-altman/ https://www.reddit.com/r/OpenAI/comments/1id3ihw/open_ai_set_to_release_o3mini_tommorow/ https://www.forexlive.com/news/openai-to-launch-new-o3-model-for-free-today-as-it-pushes-back-against-deepseek-20250131/ https://www.linkedin.com/pulse/all-users-can-access-openais-o3-mini-free-heres-what-understand-etoaf https://news.ycombinator.com/item?id=42861475 https://www.youtube.com/watch?v=CW5Ri8HfAU0 https://www.gurufocus.com/news/2676379/openai-fundraises-40b-as-deepseeks-ai-breakthrough-threatens-its-dominance https://www.linkedin.com/posts/ksred_deepseek-claims-its-reasoning-model-beats-activity-7287770597923692545-tUId https://www.reuters.com/technology/artificial-intelligence/openai-finalizes-o3-mini-reasoning-ai-model-version-launch-it-soon-2025-01-17/Weitere News-Artikel
Alle ansehen- OpenAI führt O3-Mini Modell für kostenlose ChatGPT-Nutzer ein
- OpenAI präsentiert O3-Mini: Ein Überblick über die neue Generation von Sprachmodellen
- OpenAI stellt o3-mini vor: Ein neues KI-Modell mit verbesserter Effizienz und Leistung
- OpenAIs Open-Weight-Modelle und deren Einfluss auf militärische Anwendungen
- OpenAI führt Open-Source Codex Security CLI zur Verbesserung der Code-Sicherheit ein
- OpenAI kündigt Open-Weight-Modell an: Ein neuer Ansatz in der KI-Entwicklung
KI, die in Deutschland zu Hause ist.
Testen Sie Mindverse Studio oder sprechen Sie mit unserem Team über Ihren Anwendungsfall.