---
title: "Claude Fable 5.1 made me a really nice animated pelican"
id: "42832"
slug: "claude-fable-5-1-made-me-a-really-nice-animated-pelican"
permalink: "https://eay.cc/2026/claude-fable-5-1-made-me-a-really-nice-animated-pelican/"
published_at: "2026-09-02T11:50:11+00:00"
author: "Stefan Grund"
type: "post"
format: "link"
tags:
  - "bizarres"
  - "claude"
  - "künstliche intelligenz"
external_url: "https://simonwillison.net/2026/Sep/1/claude-fable-5-1/"
short_url: "https://eay.li/45r"
content_copy:
  - "https://bubbles.town/entry/44778333"
  - "https://bsky.app/profile/eay.social/post/3mujutaxgn22m"
  - "https://eay.social/@eay/117201303939700783"
geo_latitude: "51.000119"
geo_longitude: "6.793958"
---

# Claude Fable 5.1 made me a really nice animated pelican

[Link →](https://simonwillison.net/2026/Sep/1/claude-fable-5-1/)

[Anthropic hat gestern Fable 5.1 veröffentlicht](https://www.anthropic.com/claude-fable-and-mythos-5-1), das abermals besser sein soll und definitiv teuer sein wird.

[Simon Willison](https://simonwillison.net/), der, [wie ich letztes Jahr schon schrieb](https://eay.cc/2025/pay-me-to-send-you-less/), „das unauf­geregte, täglich aktuali­sierte Must-Read-Blog für alles um Artificial Intelligence führt“, testet die Modelle seit jeher durch das [Zeichnen eines Fahrrad fahrenden Pelikans als SVG](https://simonwillison.net/tags/pelican-riding-a-bicycle/), weil das ordentlich umzu­setzen gleich mehrere Intelligence-Kapazitäten mitein­ander vereint. Am Büro­mittags­tisch sind die gelungenen und gescheiterten Pelikane seit Monaten Thema der Belustigung. Sein Bench­mark ist mittlerweile sogar so bekannt, dass vermutet wurde, die AI-Labs würden ihre Modelle [direkt auf den Pelikan-Bicycle-Test hin trainieren](https://simonwillison.net/2025/Nov/13/training-for-pelicans-riding-bicycles/), was aber nicht bestätigt werden konnte.

Jedenfalls hat Fable 5.1 in der höchsten Reasoning-Stufe „Max“ nun einen guten Pelikan gezeichnet (Kostenpunkt $3,30) und diesen sogar animiert (weitere $1,37). Die darunter liegenden Reasoning-Stufen waren z.T. deutlich schlechter, bei „Low“ und „Medium“ ist sogar gar kein Reasoning mehr erkennbar.
