Anthropic hat gestern Fable 5.1 veröffentlicht, das abermals besser sein soll und definitiv teuer sein wird.
Simon Willison, der, wie ich letztes Jahr schon schrieb, „das unaufgeregte, täglich aktualisierte Must-Read-Blog für alles um Artificial Intelligence führt“, testet die Modelle seit jeher durch das Zeichnen eines Fahrrad fahrenden Pelikans als SVG, weil das ordentlich umzusetzen gleich mehrere Intelligence-Kapazitäten miteinander vereint. Am Büromittagstisch sind die gelungenen und gescheiterten Pelikane seit Monaten Thema der Belustigung. Sein Benchmark ist mittlerweile sogar so bekannt, dass vermutet wurde, die AI-Labs würden ihre Modelle direkt auf den Pelikan-Bicycle-Test hin trainieren, was aber nicht bestätigt werden konnte.
Jedenfalls hat Fable 5.1 in der höchsten Reasoning-Stufe „Max“ nun einen guten Pelikan gezeichnet (Kostenpunkt $3,30) und diesen sogar animiert (weitere $1,37). Die darunter liegenden Reasoning-Stufen waren z.T. deutlich schlechter, bei „Low“ und „Medium“ ist sogar gar kein Reasoning mehr erkennbar.