Skip to content

Added support for prompt caching, which automatically stores and reuses prompt prefixes to reduce latency and...

UpdateUnverifiedAdded Sep 24, 2026

Added support for prompt caching, which automatically stores and reuses prompt prefixes to reduce latency and improve time to first token for similar requests. Learn more in our Prompt Caching guide.

Topics: Developer tools, Performance

Cerebras's release notes

More Cerebras Inference releases

Every Cerebras Inference release

Also shipped on Dec 10, 2025

Cerebras in December 2025

Sources: each vendor's own release notes, changelogs and GitHub releases, read daily to monthly by how often it posts. Logos via logo.dev; trademarks belong to their owners.

New releases by email

Tuesday mornings: the week's data, AI and developer-tools releases, only in weeks when something shipped.

Double opt-in. Unsubscribe any time.