Releases: probeo-io/anymodel
Release list
v0.9.1
v0.9.0 — Claude 4.7, GPT-5.5, pricing update May 2026
New models
Anthropic
- claude-opus-4-7 — Most capable model, step-change in agentic coding, 1M context, 128K max output ($5/$25 per 1M tokens)
- claude-opus-4-5 — Improved coding + workplace tasks ($5/$25)
- claude-opus-4-1 — Legacy frontier ($15/$75)
- Updated context lengths for Claude 4.6+ to 1M tokens
OpenAI
- gpt-5.5 — Smart/coding flagship, 1M context ($5/$30 per 1M tokens)
- gpt-5.5-pro — Top flagship, 1M context ($30/$180 per 1M tokens)
Pricing
Live refresh via OpenRouter API — 338 models total (was 321). Includes deepseek-v4, claude-opus-4.6-fast, and more.
Fixes
- Pricing lookup now correctly matches
claude-opus-4-7(Anthropic API dash format) toclaude-opus-4.7(OpenRouter dot format) fetch-pricing.tsnow preserves the dot/dash normalization fix on future runs- Added
o5prefix to OpenAI model listing filter
v0.8.1
v0.8.0 — Adaptive Concurrency & max_tokens Translation
What's New
Adaptive Concurrency for Concurrent Batches
Set concurrencyFallback: 'auto' to dynamically discover your provider's rate limit ceiling. Uses TCP-style slow-start (5 → 10 → 20 → 40 → ...) then AIMD for fine-tuning. Reads x-ratelimit-remaining-requests headers proactively — an OpenAI Tier 4 account ramps to ~160 concurrent in ~155 requests instead of being stuck at 5.
Add concurrencyMax for a hard ceiling when multiple jobs share an API key.
max_tokens → max_completion_tokens Translation
Newer OpenAI models (gpt-4o, o1, o3, o4-mini, gpt-5-mini) require max_completion_tokens. anymodel now detects the model and sends the correct parameter automatically — callers always just pass max_tokens.
Fixes
- Flex discount now applied on concurrent batch cost calculations (was only applied for native batches)
service_tierpersisted onBatchObjectfor accurate cost retrievalgpt-5-miniadded to token estimation limitsRateLimitTrackernow wired up — provider response headers feed into fallback routing decisions
Full changelog: https://github.com/probeo-io/anymodel/blob/main/CHANGELOG.md
v0.7.1
v0.7.0
Added
- BatchBuilder API — ergonomic batch construction with
client.batches.open(config)add(prompt)— just pass strings, persisted to disk immediatelysubmit()— formats for provider (Anthropic/OpenAI/Google) and dispatchespoll()— returns cleansucceeded/failedresults with per-item costsretry(failed)— creates a new builder pre-loaded with failed items- No custom_ids, no message formatting, no provider-specific formats — all hidden
- Poll logging:
logToConsoleoption andANYMODEL_BATCH_POLL_LOGenv var
v0.6.0
Added
- Automatic per-request cost calculation from bundled pricing data (323 models)
- Pricing fetched from OpenRouter at build time — always current as of last publish
GenerationStats.total_costnow calculated automatically from token usageBatchUsageSummary.estimated_costnow calculated automatically from token usage- Exported
getModelPricing(),calculateCost(),PRICING_AS_OF,PRICING_MODEL_COUNT batch_modeoption onBatchCreateRequest— set to"concurrent"to force individual requests (e.g. for flex pricing)service_tiersupport on batch requests (concurrent path only — native batch already discounted)
v0.5.3
v0.5.2
Added
service_tiersupport on batch requests — set per-request or as a batch-level default- Concurrent batch passes
service_tierthrough to chat completions for flex pricing - Native OpenAI batch intentionally omits
service_tier(already gets 50% off)