INTEGRITY Dokumentace

Modely

Zjistili jsme 233 modely
Logo Alibaba

hh1-i2v

AlibabaImage-to-Video

Model image-to-video HappyHorse 1.0 od Alibaby. Animuje referenční obrázek s volitelnou textovou výzvou. Podporuje výstup 720P a 1080P s délkou trvání od 3 do 15 sekund.

  • Třetí strana
  • Zero data retention
Logo Alibaba

hh1-t2v

AlibabaText-to-Video

Model text-to-video HappyHorse 1.0 od Alibaby. Generuje videa z textové výzvy s konfigurovatelným rozlišením, poměrem stran a délkou trvání (3-15 s).

  • Třetí strana
  • Zero data retention
Logo Alibaba

hh1.1-i2v

AlibabaImage-to-Video

Model image-to-video HappyHorse 1.1 od Alibaby. Animuje referenční obrázek s volitelnou textovou výzvou, s plynulejším pohybem, přirozenými texturami pokožky a vylepšenou kvalitou detailních záběrů oproti verzi 1.0. Podporuje výstup 720P a 1080P s délkou trvání od 3 do 15 sekund.

  • Třetí strana
Logo Alibaba

hh1.1-r2v

AlibabaImage-to-Video

Model reference-to-video HappyHorse 1.1 od Alibaby. Zpracuje 1 až 9 referenčních obrázků (postavy a scény) a výzvu, která je zkomponuje do jednoho videa při zachování konzistentní identity každého subjektu. Podporuje výstup 720P a 1080P s délkou trvání od 3 do 15 sekund.

  • Třetí strana
Logo Alibaba

hh1.1-t2v

AlibabaText-to-Video

Model text-to-video HappyHorse 1.1 od Alibaby. Generuje videa z textové výzvy se silnější dynamickou expresivitou, lepší vizuální kvalitou a vylepšeným dodržováním instrukcí oproti verzi 1.0. Konfigurovatelné rozlišení, poměr stran a délka trvání (3-15 s).

  • Třetí strana
Logo Alibaba

qwen-image-3.0-pro

AlibabaText-to-Image

Qwen Image 3.0 Pro od Alibaby generuje obrázky z textových výzev se zaměřením na generování složitých rozvržení, přesnost malého textu a vykreslování vícejazyčných písem. Podporuje až 6 variant obrázku na jedno volání, negativní výzvy, ovládání seedu a volitelné přepisování výzev.

  • Třetí strana
Logo Alibaba

qwen3-max

AlibabaGenerování textu

Qwen 3 Max od Alibaby je velký jazykový model se silnými schopnostmi v programování, uvažování a více jazycích, poskytovaný přes koncový bod DashScope kompatibilní s OpenAI.

  • Třetí strana
  • Zero data retention
Logo Alibaba

qwen3.5-397b-a17b

AlibabaGenerování textu

Qwen 3.5 od Alibaby je model typu mixture-of-experts s 397B parametry, z nichž 17B je aktivních, a nabízí silné schopnosti uvažování s efektivní inferencí.

  • Třetí strana
  • Zero data retention
Logo Alibaba

qwen3.7-max

AlibabaGenerování textu

Qwen 3.7 Max od Alibaby je největší a nejschopnější model v řadě Qwen3.7, vlajková loď nové generace vytvořená pro éru zaměřenou na agenty, se silnými stránkami v programování, kancelářských a produktivitních úlohách a dlouhodobém autonomním provádění, poskytovaná přes koncový bod DashScope kompatibilní s OpenAI.

  • Třetí strana
Logo Alibaba

qwen3.7-plus

AlibabaGenerování textu

Qwen 3.7 Plus od Alibaby je cenově výhodný člen řady Qwen3.7, který spojuje silné textové schopnosti s porozuměním obrazu a videu a inteligencí na úrovni agenta v celém zásobníku pro programování, používání nástrojů a automatizaci založenou na GUI, poskytovaný přes koncový bod DashScope kompatibilní s OpenAI.

  • Třetí strana
Logo Alibaba

qwen3.8-max

AlibabaGenerování textu

Qwen 3.8 Max od Alibaby je vlajková loď typu MoE s 2,4 bilionu parametrů, vytvořená pro profesionální programování a dlouhodobou autonomní práci, schopná dodávat kompletní projekty na produkční úrovni trvající 10 a více dní napříč právní, finanční, designérskou a dalšími specializovanými oblastmi. Nativní vizuální porozumění obrázkům a rozšířeným videím prochází celým cyklem plánování, provádění a ověřování, poskytovaný přes koncový bod DashScope kompatibilní s OpenAI.

  • Třetí strana
Logo Alibaba

wan-2.6-image

AlibabaText-to-Image

Model text-to-image Wan 2.6 od Alibaby generuje obrázky z textových výzev s volitelnými negativními výzvami a přizpůsobitelnými rozměry.

  • Třetí strana
  • Zero data retention
Logo Alibaba

wan-2.7-i2v

AlibabaImage-to-Video

Model image-to-video Wan 2.7 od Alibaby generuje videa z referenčního obrázku s volitelnými textovými výzvami. Podporuje výstup 720P a 1080P s délkou trvání od 2 do 15 sekund.

  • Třetí strana
  • Zero data retention
Logo Alibaba

wan-3.0

AlibabaText-to-Video

Model text-to-video Wan 3.0 od Alibaby. Generuje filmová videa z textových výzev s adaptivním poměrem stran, rozlišením 480P, 720P nebo 1080P a konfigurovatelnou délkou trvání.

  • Třetí strana
Logo Anthropic

claude-fable-5

AnthropicGenerování textu

Claude Fable 5 je nejschopnější široce dostupný model od Anthropic, určený pro nejnáročnější úlohy uvažování a dlouhodobou agentní práci. Adaptivní přemýšlení je vždy zapnuté a model podporuje kontextové okno o velikosti 1M tokenů s až 128k výstupními tokeny na požadavek.

  • Třetí strana
Logo Anthropic

claude-haiku-4.5

AnthropicGenerování textu

Claude Haiku 4.5 nabízí srovnatelný výkon v programování za třetinovou cenu a s více než dvojnásobnou rychlostí oproti větším modelům.

  • Třetí strana
  • Zero data retention
Logo Anthropic

claude-opus-4.5

AnthropicGenerování textu

Claude Opus 4.5 přináší oproti Opus 4.1 další vylepšení v uvažování, programování a agentních úlohách, s lepším využitím nástrojů a přesnějším dodržováním instrukcí.

  • Třetí strana
  • Zero data retention
Logo Anthropic

claude-opus-4.6

AnthropicGenerování textu

Claude Opus 4.6 je vlajkový jazykový model od Anthropic určený pro komplexní vícekrokové úlohy v programování, finanční analýze a právním uvažování. Ke svědomitému řešení složitých problémů využívá rozšířené přemýšlení a nabízí kontextové okno o velikosti jednoho milionu tokenů.

  • Třetí strana
  • Zero data retention
Logo Anthropic

claude-opus-4.7

AnthropicGenerování textu

Claude Opus 4.7 je nejschopnější obecně dostupný model od Anthropic, který oproti Claude Opus 4.6 přináší výrazný skok ve výkonu agentního programování. Pomocí adaptivního přemýšlení přizpůsobuje míru uvažování jednotlivým úlohám a za standardní ceny nabízí kontextové okno o velikosti jednoho milionu tokenů.

  • Třetí strana
  • Zero data retention
Logo Anthropic

claude-opus-4.8

AnthropicGenerování textu

Claude Opus 4.8 je nejschopnější obecně dostupný model od Anthropic, který oproti Claude Opus 4.7 přináší výrazný skok ve výkonu agentního programování. Pomocí adaptivního přemýšlení přizpůsobuje míru uvažování jednotlivým úlohám a za standardní ceny nabízí kontextové okno o velikosti jednoho milionu tokenů.

  • Třetí strana
  • Zero data retention
Logo Anthropic

claude-opus-5

AnthropicGenerování textu

Claude Opus 5 je model od Anthropic pro komplexní agentní programování a firemní nasazení, který nabízí inteligenci blízkou Claude Fable 5 za poloviční cenu. Pomocí adaptivního přemýšlení přizpůsobuje míru uvažování jednotlivým úlohám a za standardní ceny nabízí kontextové okno o velikosti jednoho milionu tokenů. Na rozdíl od Fable 5 nemá Opus 5 pro běžný přístup žádné požadavky na uchovávání dat.

  • Třetí strana
Logo Anthropic

claude-sonnet-4.5

AnthropicGenerování textu

Claude Sonnet 4.5 je zatím nejlepší model pro programování s výraznými vylepšeními v celém životním cyklu vývoje.

  • Třetí strana
  • Zero data retention
Logo Anthropic

claude-sonnet-4.6

AnthropicGenerování textu

Claude Sonnet 4.6 je nejnovější vyvážený model od Anthropic, který nabízí silné schopnosti v programování, uvažování a agentních úlohách spolu s lepším dodržováním instrukcí.

  • Třetí strana
  • Zero data retention
Logo Anthropic

claude-sonnet-5

AnthropicGenerování textu

Claude Sonnet 5 je zatím nejagentnější model řady Sonnet od Anthropic, určený pro programování, práci s nástroji, uvažování a dlouhodobé profesionální úlohy za nižší cenu než modely třídy Opus.

  • Třetí strana
Logo AssemblyAI

universal-3-pro

AssemblyAIAutomatické rozpoznávání řeči

Model rozpoznávání řeči Universal 3 Pro od AssemblyAI pro vysoce přesný přepis.

  • Třetí strana
  • Zero data retention
Logo AssemblyAI

universal-3.5-pro

AssemblyAIAutomatické rozpoznávání řeči

Model rozpoznávání řeči Universal-3.5 Pro od AssemblyAI pro rychlý a vysoce přesný přepis.

  • Třetí strana
Logo Black Forest Labs

flux-1-kontext-max

Black Forest LabsText-to-Image

FLUX.1 Kontext [max] je nejkvalitnější model Kontext od společnosti Black Forest Labs pro generování obrázků z textu a kontextově citlivé úpravy obrázků.

  • Třetí strana
Logo Black Forest Labs

flux-1-kontext-pro

Black Forest LabsText-to-Image

FLUX.1 Kontext [pro] vytváří a upravuje obrázky z textových promptů s vysokou konzistencí postav a stylu.

  • Třetí strana
Logo Black Forest Labs

flux-2-flex

Black Forest LabsText-to-Image

FLUX.2 [flex] je varianta FLUX.2 od společnosti Black Forest Labs s jemným řízením: nabízí nastavitelné kroky inference, guidance a prompt upsampling pro typograficky náročné a produkční workflow.

  • Třetí strana
Logo Black Forest Labs

flux-2-max

Black Forest LabsText-to-Image

FLUX.2 [max] je nejkvalitnější model pro generování obrázků od společnosti Black Forest Labs: nabízí nejvyšší konzistenci úprav, nejsilnější dodržování promptu a grounding search pro vizualizace informací v reálném čase.

  • Třetí strana
Logo Black Forest Labs

flux-2-pro-preview

Black Forest LabsText-to-Image

FLUX.2 [pro] Preview je doporučená výchozí volba společnosti Black Forest Labs pro produkční generování a úpravu obrázků: sleduje nejnovější váhy [pro] se silnou podporou více referencí.

  • Třetí strana
Logo Black Forest Labs

flux-3-video

Black Forest LabsText-to-Video

FLUX 3 Video je model společnosti Black Forest Labs pro generování videa. Vytváří video z textového promptu (t2v), oživuje jeden nebo více referenčních obrázků (i2v) nebo pokračuje v existujícím klipu (v2v), se synchronizovaným zvukem, až do rozlišení fhd a s délkou trvání 5 až 20 sekund.

  • Třetí strana
Logo Black Forest Labs

flux-video-upscale

Black Forest Labsvideo-to-video

FLUX Video Upscale zvyšuje rozlišení videa, a to buď v přesném režimu s výsledky věrnými zdroji, nebo v kreativním režimu se silnějším zvýrazněním detailů. Přijímá klipy o délce až 20 sekund a zachovává zvuk.

  • Třetí strana
Logo ByteDance

seedance-2.0

ByteDanceText-to-Video

Model ByteDance nové generace pro video s jednotnou multimodální architekturou. Generuje video ve vysoké kvalitě se synchronizovaným zvukem z textu, obrázků, videoklipů a zvukových vstupů. Podporuje multimodální reference (až 9 obrázků, 3 videa, 3 zvukové soubory), nativní generování zvuku, úpravy videa, prodloužení videa, inteligentní délku trvání a adaptivní poměr stran.

  • Třetí strana
Logo ByteDance

seedance-2.0-fast

ByteDanceText-to-Video

Rychlejší varianta modelu pro generování videa Seedance 2.0 od společnosti ByteDance. Za vyšší rychlost obětuje část kvality, přitom sdílí stejnou multimodální architekturu. Podporuje převod textu na video, převod obrázku na video, nativní generování zvuku, multimodální reference (obrázky, videa, zvuk), úpravu videa a rozšíření videa.

  • Třetí strana
Logo ByteDance

seedance-2.0-mini

ByteDanceText-to-Video

Kompaktní a nákladově efektivní model ByteDance pro generování videa z řady Seedance 2.0. Podporuje text-to-video, image-to-video, referenční video a referenční zvuk pro hudbu na pozadí. Ideální pro velké objemy úloh, kde je důležitá rychlost a cena.

  • Třetí strana
Logo ByteDance

seedance-2.5

ByteDanceText-to-Video

Model ByteDance nové generace pro video s jednotnou multimodální architekturou reference-to-video. Generuje video z textu, až 30 referenčních obrázků, 10 referenčních videí a 10 referenčních zvukových klipů, včetně čistě zvukového vstupu bez nutnosti obrázku nebo videa. Podporuje generování image-to-video z prvního nebo posledního snímku, úpravy videa, prodloužení videa, inteligentní délku trvání (včetně automatického výběru) a adaptivní poměr stran.

  • Třetí strana
Logo ByteDance

seedream-4.0

ByteDanceText-to-Image

Seedream 4.0 je model ByteDance pro tvorbu obrázků, který v jediné architektuře kombinuje generování text-to-image a úpravu obrázků, a nabízí rychlý výstup ve vysokém rozlišení až do 4K.

  • Třetí strana
Logo ByteDance

seedream-4.5

ByteDanceText-to-Image

Seedream 4.5 staví na verzi 4.0 a přidává podporu více referenčních obrázků, dávkové generování a sekvenční generování obrázků.

  • Třetí strana
Logo ByteDance

seedream-5-lite

ByteDanceText-to-Image

Seedream 5 Lite je lehčí a rychlejší verze řady Seedream 5 s podporou více referenčních obrázků a dávkového generování.

  • Třetí strana
Logo ByteDance

seedream-5-pro

ByteDanceText-to-Image

Seedream 5 Pro je vysoce kvalitní model ByteDance pro generování a úpravu obrázků s textovými prompty, až 10 referenčními obrázky a možností nastavení výstupu na 1K, 2K nebo explicitní velikost v pixelech.

  • Třetí strana

deepseek-v4-pro

deepseekGenerování textu

DeepSeek V4 Pro je vysoce výkonný model pro uvažování od DeepSeek, poskytovaný prostřednictvím infrastruktury Fireworks pro produkční inferenci.

  • Třetí strana
Logo ElevenLabs

eleven-flash-v2-5

ElevenLabsText-to-Speech

Nízkolatenční model text-to-speech Flash v2.5 od ElevenLabs pro rychlou vícejazyčnou syntézu řeči.

  • Třetí strana
Logo ElevenLabs

eleven-multilingual-v2

ElevenLabsText-to-Speech

Vícejazyčný model text-to-speech od ElevenLabs pro generování přirozené řeči ve velkém množství jazyků pomocí hlasů ElevenLabs.

  • Třetí strana
Logo ElevenLabs

eleven-turbo-v2-5

ElevenLabsText-to-Speech

Model text-to-speech Turbo v2.5 od ElevenLabs, který vyvažuje kvalitní generování hlasu s nízkou latencí ve 32 jazycích.

  • Třetí strana
Logo ElevenLabs

eleven-v3

ElevenLabsText-to-Speech

Nejnovější model text-to-speech od ElevenLabs pro vysoce expresivní a přirozenou syntézu řeči s pokročilým ovládáním hlasu.

  • Třetí strana
Logo ElevenLabs

music-v2

ElevenLabsGenerování hudby

ElevenLabs Music v2 vytváří skladby a instrumentální nahrávky z promptu nebo podrobného kompozičního plánu.

  • Třetí strana
Logo Google

gemini-2.5-flash

GoogleGenerování textu

Rychlý multimodální model Gemini 2.5 od společnosti Google se silným uvažováním a kontextovým oknem o velikosti 1M tokenů.

  • Třetí strana
  • Zero data retention
Logo Google

gemini-2.5-flash-lite

GoogleGenerování textu

Nejlehčí a nejúspornější model Gemini 2.5 od společnosti Google pro úlohy s vysokou propustností.

  • Třetí strana
  • Zero data retention
Logo Google

gemini-2.5-pro

GoogleGenerování textu

Nejschopnější model Gemini 2.5 od společnosti Google se silným uvažováním, podporou thinking režimu a kontextovým oknem o velikosti 1M tokenů.

  • Třetí strana
  • Zero data retention
Logo Google

gemini-3-flash

GoogleGenerování textu

Gemini 3 Flash je rychlý multimodální model od společnosti Google se špičkovou inteligencí, vynikajícím vyhledáváním a možnostmi groundingu.

  • Třetí strana
  • Zero data retention
Logo Google

gemini-3.1-flash-lite

GoogleGenerování textu

Nejlehčí a nejúspornější model Gemini od společnosti Google pro úlohy s vysokou propustností.

  • Třetí strana
  • Zero data retention
Logo Google

gemini-3.1-flash-tts

GoogleText-to-Speech

  • Třetí strana
  • Zero data retention
Logo Google

gemini-3.1-pro

GoogleGenerování textu

Nejinteligentnější model Gemini od společnosti Google s vylepšeným uvažováním, střední úrovní thinking režimu a kontextovým oknem o velikosti 1M tokenů.

  • Třetí strana
  • Zero data retention
Logo Google

gemini-3.5-flash

GoogleGenerování textu

Gemini 3.5 Flash je rychlý multimodální model od společnosti Google se špičkovou inteligencí, vynikajícím vyhledáváním a možnostmi groundingu.

  • Třetí strana
Logo Google

gemini-3.5-flash-lite

GoogleGenerování textu

Gemini 3.5 Flash-Lite je multimodální model s nízkou latencí a nízkými náklady, optimalizovaný pro rychlé a levné zpracování úloh subagentů a analýzu dokumentů.

  • Třetí strana
Logo Google

gemini-3.6-flash

GoogleGenerování textu

Gemini 3.6 Flash poskytuje trvale špičkovou inteligenci optimalizovanou pro reálné úlohy při vyšší rychlosti a nižších nákladech a vyniká v generování kódu, agentním provádění úloh a prostorovém uvažování.

  • Třetí strana
Logo Google

gemini-3.7-flash

GoogleGenerování textu

Gemini 3.7 Flash je vysoce výkonný, nativně multimodální model pro uvažování, optimalizovaný pro agentní workflow a reálné úlohy.

  • Třetí strana
Logo Google

nano-banana

GoogleText-to-Image

Rychlý model společnosti Google pro generování obrázků, který z textových promptů vytváří vysoce kvalitní obrázky.

  • Třetí strana
  • Zero data retention
Logo Google

nano-banana-2

GoogleText-to-Image

Model pro generování obrázků druhé generace od společnosti Google s vylepšenou kvalitou a rychlostí.

  • Třetí strana
  • Zero data retention
Logo Google

nano-banana-2-lite

GoogleText-to-Image

Nejrychlejší model Gemini od společnosti Google pro generování obrázků, určený pro rychlou tvorbu a iteraci obrázků.

  • Třetí strana
  • Zero data retention
Logo Google

nano-banana-pro

GoogleText-to-Image

Kvalitnější model pro generování obrázků od společnosti Google s vylepšenými detaily a lepším dodržováním promptů.

  • Třetí strana
  • Zero data retention
Logo Google

veo-3.1

GoogleText-to-Video

Nejnovější model pro generování videa od společnosti Google s vylepšenou kvalitou, pohybem a generováním zvuku.

  • Třetí strana
  • Zero data retention
Logo Google

veo-3.1-fast

GoogleText-to-Video

Rychlejší verze Veo 3.1 optimalizovaná pro nižší latenci při zachování vysoké kvality video a audio výstupu.

  • Třetí strana
  • Zero data retention
Logo Inworld

tts-1.5-max

InworldText-to-Speech

Nejkvalitnější text-to-speech s latencí pod 200 ms, ovládáním emocí a podporou 15 jazyků.

  • Třetí strana
  • Zero data retention
Logo Inworld

tts-1.5-mini

InworldText-to-Speech

Extrémně rychlý a nákladově efektivní převod textu na řeč s latencí přibližně 120 ms a podporou 15 jazyků.

  • Třetí strana
  • Zero data retention
Logo Inworld

tts-2

InworldText-to-Speech

Nejvýkonnější a nejexpresivnější model text-to-speech od Inworld. Navazuje na TTS 1.5 a přináší bohatě expresivní řeč, latenci v reálném čase, řízení pomocí přirozeného jazyka (např. [whisper], [say excitedly]) a lepší podporu vícejazyčnosti napříč 15 produkčními jazyky a více než 90 experimentálními jazyky.

  • Třetí strana
  • Zero data retention

krea-2-large

kreaText-to-Image

Více než dvakrát větší než Medium, s jemnějším post-tréninkem. Výstupy jsou syrovější, texturovanější a flexibilnější: model Large v nejlepších případech dosahuje výsledků, kterých Medium nedosáhne. Nejsilnější je ve fotorealismu, syrovém vzhledu (rozostření pohybem, zrno, nízký dynamický rozsah) a expresivních a uměleckých stylech.

  • Třetí strana

krea-2-medium

kreaText-to-Image

Menší, rychlejší a cenově efektivnější model. Rozsáhlé dodatečné trénování zajišťuje obzvláště stabilní a konzistentní výstupy napříč generováními. Nejsilnější je v ilustracích, anime, malbě a dalších expresivních či uměleckých stylech.

  • Třetí strana

krea-2-medium-turbo

kreaText-to-Image

Nejrychlejší model Krea 2, navržený pro levné iterace nad expresivními ilustracemi, stylově vedenými koncepty a rychlým vizuálním průzkumem. Zachovává stylový systém Krea 2 a expresivní vizuální rozsah, ale využívá destilovaný sampling schedule, takže se nápady dají procházet mnohem rychleji. Obzvlášť užitečný pro expresivní ilustrace, grafické styly, experimenty s typografií a rychlé směřování kampaní nebo konceptů.

  • Třetí strana

ltx-2-5-fast

lightricksText-to-Video

Lightricks LTX-2.5 Fast je rychlý model pro generování videa určený pro workflow text-to-video a image-to-video, se synchronizovaným zvukem a nastavitelnou délkou, rozlišením a snímkovou frekvencí.

  • Třetí strana
Logo MiniMax

hailuo-2.3

MiniMaxText-to-Video

Model pro generování videa s vysokou věrností, optimalizovaný pro realistický pohyb lidí, filmové vizuální efekty, výrazné postavy a přesné dodržování promptu a stylu v pracovních postupech text-to-video i image-to-video.

  • Třetí strana
  • Zero data retention
Logo MiniMax

hailuo-2.3-fast

MiniMaxText-to-Video

Verze Hailuo 2.3 s nižší latencí, která zachovává základní kvalitu pohybu, vizuální konzistenci a stylizaci a zároveň umožňuje rychlejší iteraci.

  • Třetí strana
  • Zero data retention
Logo MiniMax

m2.7

MiniMaxGenerování textu

Jazykový model M2.7 od MiniMaxu s podporou více jazyků.

  • Třetí strana
  • Zero data retention
Logo MiniMax

m3

MiniMaxGenerování textu

Jazykový model M3 od MiniMaxu se špičkovými schopnostmi v programování, agentními schopnostmi, kontextovým oknem o velikosti 1M tokenů a podporou více jazyků.

  • Třetí strana
  • Zero data retention
Logo MiniMax

music-2.6

MiniMaxGenerování hudby

Model pro generování hudby od MiniMaxu vytváří z textových promptů a textů písní kompletní skladby se zpěvem nebo instrumentální skladby. Podporuje ovládání BPM/tóniny a automaticky generované texty písní.

  • Třetí strana
  • Zero data retention
Logo MiniMax

speech-2.8-hd

MiniMaxText-to-Speech

MiniMax Speech 2.8 HD se zaměřuje na generování zvuku ve studiové kvalitě s ovládáním emocí, podporou více než 40 jazyků a klonováním hlasu.

  • Třetí strana
  • Zero data retention
Logo MiniMax

speech-2.8-turbo

MiniMaxText-to-Speech

MiniMax Speech 2.8 Turbo převádí text na přirozenou a výraznou řeč s klonováním hlasu, ovládáním emocí a podporou více než 40 jazyků, a to vyšší rychlostí.

  • Třetí strana
  • Zero data retention
Logo Moonshot AI

kimi-k3

Moonshot AIGenerování textu

Kimi K3 je vlajkový model společnosti Moonshot s 2.8 bilionu parametrů, postavený na mechanismu Kimi Delta Attention (hybridní lineární mechanismus pozornosti) s Attention Residuals. Nabízí nativní porozumění obrazu, trvale aktivní uvažování a kontextové okno 1M tokenů pro dlouhodobé programátorské úlohy, práci se znalostmi a náročné úlohy hlubokého uvažování.

  • Třetí strana
Logo OpenAI

gpt-4.1

OpenAIGenerování textu

Vlajkový model GPT od OpenAI pro komplexní úlohy s kontextovým oknem o velikosti milionu tokenů.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-4.1-mini

OpenAIGenerování textu

Rychlá a cenově dostupná verze GPT-4.1 s kontextovým oknem o velikosti milion tokenů.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-4.1-nano

OpenAIGenerování textu

GPT-4.1 Nano je nejmenší a nejlevnější varianta GPT-4.1 od společnosti OpenAI, optimalizovaná pro úlohy s vysokou propustností a nízkou latencí.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-4o

OpenAIGenerování textu

GPT-4o je multimodální vlajková loď společnosti OpenAI, která přijímá text i obrázky a rychle reaguje na širokou škálu úloh.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-4o-mini

OpenAIGenerování textu

GPT-4o Mini je odlehčená a levná varianta GPT-4o, vhodná pro objemné úlohy s multimodálními vstupy.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-4o-transcribe

OpenAIAutomatické rozpoznávání řeči

Model pro převod řeči na text, který k přepisu zvuku využívá GPT-4o s nižší chybovostí slov a lepším rozpoznáváním jazyka než původní modely Whisper.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-5

OpenAIGenerování textu

Model OpenAI, který vyniká v programování, psaní a uvažování.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-5-mini

OpenAIGenerování textu

GPT-5 Mini je odlehčená a levná varianta GPT-5, vhodná pro objemné úlohy v oblasti programování a uvažování.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-5-nano

OpenAIGenerování textu

GPT-5 Nano je nejmenší varianta GPT-5 od společnosti OpenAI, optimalizovaná pro úlohy s nízkou latencí a levnou vysokou propustností.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-5.1

OpenAIGenerování textu

GPT-5.1 je postupné vylepšení modelu GPT-5 od společnosti OpenAI s lepšími schopnostmi v programování, uvažování a psaní.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-5.4

OpenAIGenerování textu

GPT-5.4 je vlajkový model společnosti OpenAI se silnými schopnostmi v programování, uvažování a multimodálním zpracování.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-5.4-mini

OpenAIGenerování textu

GPT-5.4 mini je menší, rychlejší a cenově efektivnější verze modelu GPT-5.4 určená pro jednodušší úlohy.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-5.4-nano

OpenAIGenerování textu

GPT-5.4 nano je nejmenší a nejrychlejší model společnosti OpenAI, optimalizovaný pro edge nasazení a případy použití s nízkou latencí.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-5.4-pro

OpenAIGenerování textu

GPT-5.4 pro využívá Responses API od společnosti OpenAI se zabudovanými nástroji, vylepšeným uvažováním a stavovou správou kontextu.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-5.5

OpenAIGenerování textu

GPT-5.5 je vlajkový model společnosti OpenAI se silnými schopnostmi v programování, uvažování a multimodálním zpracování.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-5.5-pro

OpenAIGenerování textu

GPT-5.5 pro využívá Responses API od společnosti OpenAI se zabudovanými nástroji, vylepšeným uvažováním a stavovou správou kontextu.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-5.6-luna

OpenAIGenerování textu

GPT-5.6 Luna je model řady GPT-5.6 od společnosti OpenAI, optimalizovaný pro nákladově citlivé úlohy, který využívá Responses API pro efektivní generování textu.

  • Třetí strana
Logo OpenAI

gpt-5.6-sol

OpenAIGenerování textu

GPT-5.6 Sol je špičkový model řady GPT-5.6 od společnosti OpenAI určený pro náročnou profesionální práci, který využívá Responses API pro uvažování a stavovou správu kontextu.

  • Třetí strana
Logo OpenAI

gpt-5.6-terra

OpenAIGenerování textu

GPT-5.6 Terra je model řady GPT-5.6 od společnosti OpenAI, který vyvažuje inteligenci a náklady a využívá Responses API pro uvažování a stavovou správu kontextu.

  • Třetí strana
Logo OpenAI

gpt-image-1.5

OpenAIText-to-Image

Model OpenAI pro generování obrázků, který vytváří a upravuje obrázky na základě textových promptů a podporuje více úrovní kvality a výstupních velikostí.

  • Třetí strana
  • Zero data retention
Logo OpenAI

gpt-image-2

OpenAIText-to-Image

Model OpenAI nové generace, který vytváří a upravuje obrázky na základě textových promptů, s podporou více úrovní kvality, velikostí a výstupních formátů. Poznámka: průhledná pozadí nejsou podporována, pro průhledná PNG použijte openai/gpt-image-1.5.

  • Třetí strana
  • Zero data retention
Logo OpenAI

o3

OpenAIGenerování textu

o3 je univerzální model OpenAI pro usuzování, který kombinuje silný analytický výkon s přiměřenou latencí a cenou.

  • Třetí strana
  • Zero data retention
Logo OpenAI

o3-mini

OpenAIGenerování textu

o3-mini je odlehčená a levnější varianta modelu o3 pro usuzování, vhodná pro rychlé analytické úlohy ve velkém měřítku.

  • Třetí strana
  • Zero data retention
Logo OpenAI

o4-mini

OpenAIGenerování textu

Rychlý a odlehčený reasoning model OpenAI optimalizovaný pro vícekrokové řešení problémů za nižší náklady.

  • Třetí strana
  • Zero data retention
Logo OpenAI

tts-1

OpenAIText-to-Speech

Model OpenAI pro text-to-speech optimalizovaný pro použití v reálném čase s nízkou latencí.

  • Třetí strana
  • Zero data retention
Logo OpenAI

tts-1-hd

OpenAIText-to-Speech

Vysoce kvalitní model OpenAI pro text-to-speech, který poskytuje zvukový výstup ve vyšší kvalitě.

  • Třetí strana
  • Zero data retention
Logo PixVerse

v5.6

PixVerseText-to-Video

Pixverse v5.6 je model pro generování videa, který podporuje převod textu na video i obrazu na video, generování zvuku, upravitelný poměr stran a výstup až v rozlišení 1080p.

  • Třetí strana
  • Zero data retention
Logo PixVerse

v6

PixVerseText-to-Video

Pixverse v6 je nejnovější videomodel od Pixverse s podporou videí až o délce 15 sekund, upravitelnou délkou od 1 do 15 sekund a generováním zvuku.

  • Třetí strana
  • Zero data retention
Logo Pruna AI

p-image

Pruna AIText-to-Image

P-Image od Pruny je ultrarychlý model pro převod textu na obraz s automatickým vylepšením promptu a dvoufázovým zpřesněním, který spojuje výjimečnou rychlost s vysoce kvalitním výstupem a flexibilním poměrem stran.

  • Třetí strana
Logo Pruna AI

p-image-edit

Pruna AIImage-to-Image

P-Image-Edit od Pruny upravuje a skládá 1 až 5 referenčních obrázků podle textových pokynů. Podporuje složité kompozice, přenos stylu a cílené úpravy s flexibilním poměrem stran výstupu.

  • Třetí strana
Logo Pruna AI

p-image-try-on

Pruna AIImage-to-Image

P-Image Try-On od Pruny virtuálně obléká jeden nebo více kusů oblečení na fotografii osoby. Nahrajte fotografii osoby spolu s referenčními obrázky oblečení a model danou osobu realisticky obleče do zadaného oblečení.

  • Třetí strana
Logo Pruna AI

p-image-upscale

Pruna AIImage-to-Image

P-Image-Upscale od Pruny zvyšuje rozlišení obrázků pomocí AI, a to v rozsahu 1 až 128 megapixelů, s volitelným vylepšením detailů a realismu pro ostřejší a čistší výsledky.

  • Třetí strana
Logo Pruna AI

p-video

Pruna AIText-to-Video

P-Video od Pruny je prémiový model pro generování videa, který podporuje převod textu na video, obrazu na video a generování podmíněné zvukem až v rozlišení 1080p při 24 nebo 48 fps, s nastavitelnou délkou až 20 sekund.

  • Třetí strana
Logo Pruna AI

p-video-animate

Pruna AIImage-to-Video

P-Video-Animate od Pruny vezme zdrojové video a referenční obrázek subjektu a poté daný subjekt animuje pomocí pohybu a zvuku ze zdrojového videa.

  • Třetí strana
Logo Pruna AI

p-video-avatar

Pruna AIImage-to-Video

P-Video-Avatar od Pruny generuje z jediné portrétní fotografie mluvící video řízené textovým scénářem nebo zvukovým souborem, s podporou více hlasů, jazyků a výstupních rozlišení.

  • Třetí strana
Logo Pruna AI

p-video-replace

Pruna AIImage-to-Video

P-Video-Replace od Pruny vezme zdrojové video a jeden nebo více referenčních obrázků identity a poté do videa umístí danou osobu nebo osoby při zachování původního pohybu a zvuku.

  • Třetí strana
Logo Recraft

recraftv3

RecraftText-to-Image

Recraft V3 je model pro převod textu na obraz předchozí generace od společnosti Recraft, vhodný pro kompozice v kvalitě pro grafický design, obrazy respektující identitu značky a přesné vykreslování textu.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4

RecraftText-to-Image

Recraft V4 generuje obrazy s uměleckým směřováním, silnou kompozicí, přesným vykreslováním textu a vestavěným smyslem pro design. Je rychlý a cenově efektivní ve standardním rozlišení.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4-1

RecraftText-to-Image

Recraft V4.1 vytváří umělecky laděné obrázky zaměřené na vysokou estetiku, se silnou kompozicí, přesným vykreslením textu a vytříbeným smyslem pro design. Ve standardním rozlišení je rychlý a nákladově efektivní.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4-1-pro

RecraftText-to-Image

Recraft V4.1 Pro generuje vysoce kvalitní obrazy s uměleckým směřováním v rozlišení 2048px+, laděné na vysokou estetiku, se silnou kompozicí, vykreslováním textu a vytříbeným smyslem pro design. Je určený pro tisk a produkční práci.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4-1-pro-vector

RecraftText-to-Image

Generujte podrobnou vektorovou grafiku SVG ve vysokém rozlišení z textových promptů s vysokou estetickou kvalitou a jemnou geometrií, škálovatelnou na libovolnou velikost pro tisk a návrhářské práce.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4-1-utility

RecraftText-to-Image

Recraft V4.1 Utility je univerzální model pro převod textu na obraz, který vyvažuje kvalitu a flexibilitu pro širokou škálu běžných případů užití ve standardním rozlišení.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4-1-utility-pro

RecraftText-to-Image

Recraft V4.1 Utility Pro je univerzální model pro převod textu na obraz, který vytváří vysoce kvalitní výstup v rozlišení 2048px+ pro širokou škálu produkčních a tiskových případů užití.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4-1-utility-pro-vector

RecraftText-to-Image

Generujte podrobnou vektorovou grafiku SVG ve vysokém rozlišení z textových promptů pomocí univerzálního modelu, škálovatelnou na libovolnou velikost pro tisk a rozsáhlé návrhářské práce.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4-1-utility-vector

RecraftText-to-Image

Generujte produkčně připravenou vektorovou grafiku SVG z textových promptů pomocí univerzálního modelu vhodného pro širokou škálu návrhářských a ilustračních úloh.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4-1-vector

RecraftText-to-Image

Generujte produkčně připravenou vektorovou grafiku SVG z textových promptů s vysokou estetickou kvalitou, čistou geometrií, strukturovanými vrstvami a upravitelnými cestami.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4-pro

RecraftText-to-Image

Recraft V4 Pro generuje vysoce kvalitní obrazy s uměleckým směřováním v rozlišení 2048px+, se silnou kompozicí, kvalitním vykreslováním textu a smyslem pro design. Je určený pro tisk a produkční práci.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4-pro-vector

RecraftText-to-Image

Generujte podrobnou, produkčně připravenou vektorovou grafiku SVG z textových promptů s jemnou geometrií, škálovatelnou na libovolnou velikost pro tisk a návrhářské práce.

  • Třetí strana
  • Zero data retention
Logo Recraft

recraftv4-vector

RecraftText-to-Image

Generujte produkčně připravenou vektorovou grafiku SVG z textových promptů s čistou geometrií, strukturovanými vrstvami a upravitelnými cestami.

  • Třetí strana
  • Zero data retention
Logo RunwayML

aleph-2

RunwayMLText-to-Video

Model RunwayML pro úpravu videa. Úpravou jednoho snímku aktualizujete celé video, provádíte změny napříč více záběry a pracujete s videem o délce až 30 sekund. Podporuje úpravy řízené klíčovými snímky pro přesnou kontrolu nad konkrétními okamžiky ve videoklipu.

  • Třetí strana
Logo RunwayML

gen-4.5

RunwayMLText-to-Video

Model RunwayML pro generování videa podporující text-to-video i image-to-video s upravitelnou délkou, poměrem stran a možnostmi moderování obsahu.

  • Třetí strana

inkling

thinkingmachinesGenerování textu

Inkling je hybridní reasoning model s otevřenými váhami od společnosti Thinking Machines, postavený na architektuře mixture-of-experts. Ve výchozím nastavení uvažuje a svůj chain-of-thought vystavuje jako úvodní bloky obsahu typu thinking, přičemž reasoning effort lze doladit pomocí parametru output_config.effort specifického pro Tinker. Model je dostupný prostřednictvím beta koncového bodu Tinkeru kompatibilního s Anthropic Messages, a to spolu s podporou tool use, streamování a vícekolových konverzací. V současnosti je určen spíše pro testování s nízkým provozem a interní použití než pro produkční nasazení s vysokou propustností; tento koncový bod nepodporuje prompt caching, citace ani zvukový vstup.

  • Třetí strana

inkling-256k

thinkingmachinesGenerování textu

256K kontextová varianta modelu Inkling, otevřeného hybridního reasoning MoE modelu s otevřenými váhami od společnosti Thinking Machines. Nabízí stejnou podporu hybridního reasoningu, používání nástrojů a streamování jako základní model, navíc s rozšířeným kontextovým oknem pro delší konverzace a dokumenty. V současné době je určena spíše pro testování s nízkým provozem a interní použití než pro produkční nasazení s vysokou zátěží.

  • Třetí strana
Logo Vidu

q3-pro

ViduText-to-Video

Vidu Q3 Pro je vysoce kvalitní model pro generování videa, který podporuje převod textu na video, obrázku na video a workflow s počátečním/koncovým snímkem videa, včetně zvuku a klipů o délce až 16 sekund.

  • Třetí strana
  • Zero data retention
Logo Vidu

q3-turbo

ViduText-to-Video

Vidu Q3 Turbo je rychlejší verze modelu Vidu Q3 optimalizovaná na nižší latenci generování videa, přičemž si zachovává podporu zvuku a klipy o délce až 16 sekund.

  • Třetí strana
  • Zero data retention
logo xAI

grok-4.20-0309-non-reasoning

xAIGenerování textu

Nereasoningový model Grok 4.20 od xAI. Vynechává thinking trace a poskytuje rychlé odpovědi v jediném kroku, přičemž si zachovává stejné trénování jako varianta s reasoning.

  • Třetí strana
  • Zero data retention
logo xAI

grok-4.20-0309-reasoning

xAIGenerování textu

Reasoning model Grok 4.20 od xAI. Využívá rozšířené přemýšlení k řešení složitých problémů a spolu s konečnou odpovědí vrací reasoning trace.

  • Třetí strana
  • Zero data retention
logo xAI

grok-4.20-multi-agent-0309

xAIGenerování textu

Multiagentní model Grok 4.20 od xAI s kontextovým oknem 2M tokenů. Více agentů spolupracuje paralelně na hloubkových výzkumných úlohách, s podporou volání funkcí, strukturovaných výstupů a schopností reasoning.

  • Třetí strana
  • Zero data retention
logo xAI

grok-4.3

xAIGenerování textu

Model Grok 4.3 od xAI s kontextovým oknem 1M tokenů a silným agentním voláním nástrojů s minimem halucinací. Přijímá textové i obrazové vstupy a podporuje volání funkcí, strukturované výstupy a nastavitelný reasoning effort (none, low, medium, high).

  • Třetí strana
  • Zero data retention
logo xAI

grok-4.5

xAIGenerování textu

Grok 4.5 od xAI, špičkový model určený pro programování, agentní úlohy a znalostní práci. Přijímá textové i obrazové vstupy a podporuje volání funkcí, strukturované výstupy a nastavitelný reasoning effort (low, medium, high).

  • Třetí strana
  • Zero data retention
logo xAI

grok-4.6

xAIGenerování textu

Grok 4.6 od xAI, vlajkový reasoning model pro programování, agentní úlohy a práci s obrazem. Přijímá textové i obrazové vstupy a podporuje volání funkcí a strukturované výstupy.

  • Třetí strana
  • Zero data retention
logo xAI

grok-imagine-image

xAIText-to-Image

Model Grok Imagine od xAI pro práci s obrázky. Generuje a upravuje obrázky na základě textových vstupů a referenčních obrázků, s nastavitelným poměrem stran a rozlišením.

  • Třetí strana
  • Zero data retention
logo xAI

grok-imagine-image-2.0

xAIText-to-Image

Grok Imagine Image 2.0 od xAI je přesný model pro generování a úpravu obrázků určený pro tvůrčí práci, s důrazem na dodržování pokynů, typografii, rozvržení a zachování referenčního obrázku.

  • Třetí strana
logo xAI

grok-imagine-image-quality

xAIText-to-Image

Věrnější model xAI pro převod textu na obraz, optimalizovaný pro ostřejší detaily, přesnější kompozice a kvalitnější vykreslování textu. Podporuje úpravu obrázků pomocí referenčních obrázků a masek. Ve srovnání s grok-imagine-image obětuje rychlost ve prospěch kvality. Výchozí výstup má rozlišení 2k.

  • Třetí strana
  • Zero data retention
logo xAI

grok-imagine-video

xAIText-to-Video

Model xAI pro generování videa. Generuje, upravuje a prodlužuje videa na základě textových a obrazových vstupů s nativně synchronizovaným zvukem včetně dialogů, zvukových efektů a hudby. Podporuje více tvůrčích režimů (normal, fun, custom).

  • Třetí strana
  • Zero data retention
logo xAI

grok-imagine-video-1.5-preview

xAIImage-to-Video

Model xAI nové generace pro generování videa. Generuje, upravuje a prodlužuje videa na základě textových a obrazových vstupů. Podporuje více poměrů stran a rozlišení s vyšší kvalitou oproti předchozí generaci.

  • Třetí strana
  • Zero data retention
logo xAI

grok-stt

xAIAutomatické rozpoznávání řeči

Model Grok pro převod řeči na text od xAI. Přepisuje zvukové soubory do textu ve 25 jazycích, s časovými značkami na úrovni jednotlivých slov, vícekanálovým přepisem, diarizací mluvčích a zvýhodňováním klíčových termínů.

  • Třetí strana
  • Zero data retention
logo xAI

grok-tts

xAIText-to-Speech

Model Grok pro převod textu na řeč od xAI. Generuje věrný mluvený zvuk v 5 expresivních hlasech (eve, ara, rex, sal, leo) s podporou více než 20 jazyků. Podporuje vkládané značky řeči pro smích, šepot a pauzy.

  • Třetí strana
  • Zero data retention
logo xAI

grok-voice

xAIwebsocket

Model xAI pro hlasovou konverzaci v reálném čase s nízkou latencí vstupního a výstupního zvukového streamování.

  • Třetí strana
  • Zero data retention
Logo Deepgram

aura-1

DeepgramText-to-Speech

Aura je kontextově uvědomělý model převodu textu na řeč (TTS), který na základě kontextu zadaného textu aplikuje přirozené tempo, expresivitu a výplňová slova. Kvalita vstupního textu přímo ovlivňuje přirozenost výsledného zvuku.

  • Hostováno Cloudflare
  • Batch
  • Partner
  • V reálném čase
Logo Deepgram

aura-2-en

DeepgramText-to-Speech

Aura-2 je kontextově uvědomělý model převodu textu na řeč (TTS), který na základě kontextu zadaného textu aplikuje přirozené tempo, expresivitu a výplňová slova. Kvalita vstupního textu přímo ovlivňuje přirozenost výsledného zvuku.

  • Hostováno Cloudflare
  • Batch
  • Partner
  • V reálném čase
Logo Deepgram

aura-2-es

DeepgramText-to-Speech

Aura-2 je kontextově uvědomělý model převodu textu na řeč (TTS), který na základě kontextu zadaného textu aplikuje přirozené tempo, expresivitu a výplňová slova. Kvalita vstupního textu přímo ovlivňuje přirozenost výsledného zvuku.

  • Hostováno Cloudflare
  • Batch
  • Partner
  • V reálném čase
Logo Meta

bart-large-cnn

Beta
MetaShrnování

BART je transformerový model typu encoder-encoder (seq2seq) s obousměrným (BERT-like) enkodérem a autoregresivním (GPT-like) dekodérem. Tento model lze použít pro shrnutí textu.

  • Hostováno Cloudflare
  • Zastaralé
Logo BAAI

bge-base-en-v1.5

BAAITextové embeddingy

Obecný embedding model BAAI (Base), který převádí libovolný zadaný text na 768rozměrný vektor

  • Hostováno Cloudflare
  • Batch
Logo BAAI

bge-large-en-v1.5

BAAITextové embeddingy

Obecný embedding model BAAI (Large), který převádí libovolný zadaný text na 1024rozměrný vektor

  • Hostováno Cloudflare
  • Batch
Logo BAAI

bge-m3

BAAITextové embeddingy

Model embeddingů s multifunkčností, vícejazyčností a multigranularitou.

  • Hostováno Cloudflare
Logo BAAI

bge-reranker-base

BAAIKlasifikace textu

Na rozdíl od embedding modelu bere reranker jako vstup dotaz a dokument a přímo vrací míru podobnosti místo embeddingu. Zadáním dotazu a úryvku textu do rerankeru získáte skóre relevance, které lze pomocí sigmoidní funkce převést na desetinnou hodnotu v rozsahu [0,1].

  • Hostováno Cloudflare
Logo BAAI

bge-small-en-v1.5

BAAITextové embeddingy

Obecný embedding model BAAI (Small), který převádí libovolný zadaný text na 384rozměrný vektor

  • Hostováno Cloudflare
  • Batch
Logo DeepSeek

deepseek-r1-distill-qwen-32b

DeepSeekGenerování textu

DeepSeek-R1-Distill-Qwen-32B je model destilovaný z DeepSeek-R1 na základě Qwen2.5. Překonává OpenAI-o1-mini v celé řadě benchmarků a dosahuje nových špičkových výsledků mezi hustými modely.

  • Hostováno Cloudflare
  • Uvažování
Logo DeepSeek

deepseek-v4-flash-0731

DeepSeekGenerování textu

DeepSeek-V4-Flash-0731 je oficiální vydání modelu DeepSeek-V4-Flash, které nahrazuje jeho náhledovou verzi a přináší podstatně vylepšené agentní schopnosti.

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
Logo DeepSeek

deepseek-v4-pro-0813

DeepSeekGenerování textu

DeepSeek V4 Pro je vysoce výkonný model pro pokročilé uvažování od společnosti DeepSeek s kontextovým oknem o velikosti jeden milion tokenů, určený pro dlouhodobé agentní workflow a řešení komplexních vícekrokových úloh

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
Logo Meta

detr-resnet-50

Beta
MetaObject Detection

Model DEtection TRansformer (DETR) trénovaný metodou end-to-end na detekci objektů COCO 2017 (118k anotovaných obrázků).

  • Hostováno Cloudflare
Logo HuggingFace

distilbert-sst-2-int8

HuggingFaceKlasifikace textu

Destilovaný model BERT doladěný na datové sadě SST-2 pro klasifikaci sentimentu

  • Hostováno Cloudflare

dreamshaper-8-lcm

lykonText-to-Image

Model Stable Diffusion doladěný tak, aby lépe dosahoval fotorealismu, aniž by ztratil na všestrannosti.

  • Hostováno Cloudflare
Logo Google

embeddinggemma-300m

GoogleTextové embeddingy

EmbeddingGemma je otevřený embedding model se 300 miliony parametrů od Googlu, který ve své velikostní kategorii dosahuje špičkových výsledků. Vychází z modelu Gemma 3 (s inicializací T5Gemma) a využívá stejný výzkum a technologie jako modely Gemini. EmbeddingGemma vytváří vektorové reprezentace textu, díky čemuž se hodí pro vyhledávání a získávání informací, včetně klasifikace, shlukování a hledání sémantické podobnosti. Model byl trénován na datech ve více než 100 mluvených jazycích.

  • Hostováno Cloudflare
Logo Deepgram

flux

DeepgramAutomatické rozpoznávání řeči

Flux je první konverzační model pro rozpoznávání řeči vytvořený speciálně pro hlasové agenty.

  • Hostováno Cloudflare
  • Partner
  • V reálném čase
Logo Black Forest Labs

flux-1-schnell

Black Forest LabsText-to-Image

FLUX.1 [schnell] je rectified flow transformer se 12 miliardami parametrů, který dokáže generovat obrázky z textového popisu.

  • Hostováno Cloudflare
Logo Black Forest Labs

flux-2-dev

Black Forest LabsText-to-Image

FLUX.2 [dev] je obrazový model od Black Forest Labs, ve kterém můžete generovat velmi realistické a detailní obrázky, s podporou více referenčních obrázků.

  • Hostováno Cloudflare
  • Partner
Logo Black Forest Labs

flux-2-klein-4b

Black Forest LabsText-to-Image

FLUX.2 [klein] je extrémně rychlý destilovaný obrazový model. Spojuje generování a úpravu obrázků do jediného modelu a nabízí špičkovou kvalitu, díky které je vhodný pro interaktivní pracovní postupy, náhledy v reálném čase i aplikace citlivé na latenci.

  • Hostováno Cloudflare
  • Partner
Logo Black Forest Labs

flux-2-klein-9b

Black Forest LabsText-to-Image

FLUX.2 [klein] 9B je extrémně rychlý destilovaný obrazový model se zvýšenou kvalitou. Spojuje generování a úpravu obrázků do jediného modelu a nabízí špičkovou kvalitu, díky které je vhodný pro interaktivní pracovní postupy, náhledy v reálném čase i aplikace citlivé na latenci.

  • Hostováno Cloudflare
  • Partner
Logo Google

gemma-2b-it-lora

Beta
GoogleGenerování textu

Toto je základní model Gemma-2B, který Cloudflare vyhrazuje pro inferenci s adaptéry LoRA. Gemma je rodina lehkých, špičkových otevřených modelů od Googlu, postavených na stejném výzkumu a technologii jako modely Gemini.

  • Hostováno Cloudflare
  • LoRA
Logo Google

gemma-3-12b-it

GoogleGenerování textu

Modely Gemma 3 se dobře hodí pro řadu úloh generování textu a porozumění obrázkům, včetně odpovídání na otázky, shrnování a uvažování. Modely Gemma 3 jsou multimodální: zpracovávají textový a obrazový vstup a generují textový výstup, mají velké kontextové okno 128K, podporují více než 140 jazyků a jsou dostupné ve více velikostech než předchozí verze.

  • Hostováno Cloudflare
  • LoRA
  • Zastaralé
Logo Google

gemma-4-26b-a4b-it

GoogleGenerování textu

Gemma 4 je nejinteligentnější rodina otevřených modelů od Googlu, postavená na výzkumu Gemini 3 s cílem maximalizovat inteligenci na parametr.

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
  • Vision
Logo Google

gemma-7b-it

Beta
GoogleGenerování textu

Gemma je rodina lehkých, špičkových otevřených modelů od Googlu, postavených na stejném výzkumu a technologii, jaké se použily při vytváření modelů Gemini. Jde o velké jazykové modely typu text-to-text s architekturou pouze dekodéru, dostupné v angličtině, s otevřenými váhami, předtrénovanými variantami i variantami doladěnými na instrukce.

  • Hostováno Cloudflare
  • LoRA
  • Zastaralé
Logo Google

gemma-7b-it-lora

Beta
GoogleGenerování textu

Toto je základní model Gemma-7B, který Cloudflare vyhrazuje pro inferenci s adaptéry LoRA. Gemma je rodina lehkých, špičkových otevřených modelů od Googlu, postavených na stejném výzkumu a technologii, jaké se použily při vytváření modelů Gemini.

  • Hostováno Cloudflare
  • LoRA

gemma-sea-lion-v4-27b-it

aisingaporeGenerování textu

SEA-LION je zkratka pro Southeast Asian Languages In One Network. Jde o kolekci velkých jazykových modelů (LLM), které byly předtrénovány a instrukčně doladěny pro region jihovýchodní Asie (SEA).

  • Hostováno Cloudflare
Logo Zhipu AI

glm-4.7-flash

Zhipu AIGenerování textu

GLM-4.7-Flash je rychlý a efektivní vícejazyčný model pro generování textu s kontextovým oknem 131,072 tokenů. Je optimalizovaný na dialog, dodržování instrukcí a vícekolové volání nástrojů ve více než 100 jazycích.

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
Logo Zhipu AI

glm-5.2

Zhipu AIGenerování textu

Vlajkový agentní model pro programování od Z.ai

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
Logo Zhipu AI

glm-5.3-flash

Zhipu AIGenerování textu

První nativně multimodální model v řadě GLM-5. S 320 miliardami parametrů celkem a jen 18 miliardami aktivních parametrů překonává GLM-5.2 v benchmarcích i v reálném provozu za desetinu ceny, přičemž se v benchmarcích zaměřených na programování a agentní úlohy blíží modelu Claude Opus 4.8.

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
  • Vision
Logo OpenAI

gpt-oss-120b

OpenAIGenerování textu

Modely OpenAI s otevřenými váhami jsou určené pro náročné uvažování, agentní úlohy a všestranné využití u vývojářů: gpt-oss-120b je určen pro produkční nasazení, obecné účely a úlohy vyžadující vysokou úroveň uvažování.

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
Logo OpenAI

gpt-oss-20b

OpenAIGenerování textu

Modely OpenAI s otevřenými váhami jsou určené pro náročné uvažování, agentní úlohy a všestranné využití u vývojářů: gpt-oss-20b je určen pro nižší latenci a lokální nebo specializované použití.

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
Logo IBM

granite-4.0-h-micro

IBMGenerování textu

Instrukční modely Granite 4.0 dosahují vynikajícího výkonu napříč benchmarky a v klíčových agentních úlohách, jako je dodržování instrukcí a volání funkcí, patří ke špičce v oboru. Díky této efektivitě se modely dobře hodí pro širokou škálu případů použití, jako je retrieval-augmented generation (RAG), víceagentní workflow a nasazení na okraji sítě.

  • Hostováno Cloudflare
  • Volání funkcí

hermes-2-pro-mistral-7b

Beta
nousresearchGenerování textu

Hermes 2 Pro na bázi Mistral 7B je nová vlajková loď řady 7B Hermes! Jde o vylepšenou a přetrénovanou verzi modelu Nous Hermes 2, která vychází z aktualizované a vyčištěné verze datové sady OpenHermes 2.5 a nově zahrnuje i interně vyvinutou datovou sadu Function Calling and JSON Mode.

  • Hostováno Cloudflare
  • Volání funkcí
  • Zastaralé

indictrans2-en-indic-1B

ai4bharatPřeklad

IndicTrans2 je první open-source vícejazyčný NMT model založený na transformeru, který podporuje kvalitní překlady mezi všemi 22 plánovanými indickými jazyky

  • Hostováno Cloudflare
Logo Moonshot AI

kimi-k2.5

Moonshot AIGenerování textu

Kimi K2.5 je open-source model špičkové třídy s kontextovým oknem 256k, podporou vícekolového volání nástrojů, vizuálními vstupy a strukturovanými výstupy pro agentní úlohy.

  • Hostováno Cloudflare
  • Volání funkcí
  • Zastaralé
  • Uvažování
  • Vision
Logo Moonshot AI

kimi-k2.6

Moonshot AIGenerování textu

Kimi K2.6 je open-source model špičkové třídy s 1T parametry, kontextovým oknem 262.1k, podporou vícekolového volání nástrojů, vizuálními vstupy a strukturovanými výstupy pro agentní úlohy.

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
  • Vision
Logo Moonshot AI

kimi-k2.7-code

Moonshot AIGenerování textu

Kimi K2.7 je open-source model špičkové třídy s 1T parametry, kontextovým oknem 262.1k, podporou vícekolového volání nástrojů, vizuálními vstupy a strukturovanými výstupy pro agentní úlohy.

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
  • Vision
Logo Meta

llama-2-7b-chat-fp16

MetaGenerování textu

Model pro generování textu s plnou přesností (fp16) a 7 miliardami parametrů od Meta

  • Hostováno Cloudflare
  • Zastaralé
Logo Meta

llama-2-7b-chat-hf-lora

Beta
MetaGenerování textu

Toto je základní model Llama2, který Cloudflare vyhradil pro inferenci s adaptéry LoRA. Llama 2 je řada předtrénovaných a doladěných generativních textových modelů s rozsahem od 7 miliard do 70 miliard parametrů. Toto je repozitář doladěného modelu 7B, optimalizovaného pro dialogové scénáře a převedeného do formátu Hugging Face Transformers.

  • Hostováno Cloudflare
  • LoRA
Logo Meta

llama-2-7b-chat-int8

MetaGenerování textu

Kvantizovaný (int8) generativní textový model se 7 miliardami parametrů od společnosti Meta

  • Hostováno Cloudflare
  • Zastaralé
Logo Meta

llama-3-8b-instruct

MetaGenerování textu

S každou další generací dosahuje Meta Llama 3 špičkového výkonu v široké škále odvětvových benchmarků a nabízí nové možnosti, včetně vylepšeného uvažování.

  • Hostováno Cloudflare
  • Zastaralé
Logo Meta

llama-3-8b-instruct-awq

MetaGenerování textu

Kvantizovaný (int4) generativní textový model se 8 miliardami parametrů od společnosti Meta.

  • Hostováno Cloudflare
  • Zastaralé
Logo Meta

llama-3.1-70b-instruct

MetaGenerování textu

Kolekce Meta Llama 3.1 zahrnuje vícejazyčné velké jazykové modely (LLM), tedy generativní modely předtrénované a doladěné na instrukce. Textové modely Llama 3.1 doladěné na instrukce jsou optimalizované pro vícejazyčné dialogové scénáře a v běžných odvětvových benchmarcích překonávají řadu dostupných open source i uzavřených chatovacích modelů.

  • Hostováno Cloudflare
  • Zastaralé
Logo Meta

llama-3.1-8b-instruct

MetaGenerování textu

Kolekce Meta Llama 3.1 zahrnuje vícejazyčné velké jazykové modely (LLM), tedy generativní modely předtrénované a doladěné na instrukce. Textové modely Llama 3.1 doladěné na instrukce jsou optimalizované pro vícejazyčné dialogové scénáře a v běžných odvětvových benchmarcích překonávají řadu dostupných open source i uzavřených chatovacích modelů.

  • Hostováno Cloudflare
  • Zastaralé
Logo Meta

llama-3.1-8b-instruct-awq

MetaGenerování textu

Kvantizovaný (int4) generativní textový model se 8 miliardami parametrů od společnosti Meta.

  • Hostováno Cloudflare
  • Zastaralé
Logo Meta

llama-3.1-8b-instruct-fast

MetaGenerování textu

[Rychlá verze] Kolekce Meta Llama 3.1 vícejazyčných velkých jazykových modelů (LLM) obsahuje předtrénované a instrukčně doladěné generativní modely. Textové modely Llama 3.1 doladěné na instrukce jsou optimalizované pro vícejazyčné konverzační scénáře a v běžných oborových testech překonávají mnohé dostupné open source i uzavřené chatovací modely.

  • Hostováno Cloudflare
Logo Meta

llama-3.1-8b-instruct-fp8

MetaGenerování textu

Llama 3.1 8B kvantovaná na přesnost FP8

  • Hostováno Cloudflare
Logo Meta

llama-3.2-11b-vision-instruct

MetaGenerování textu

Modely Llama 3.2-Vision doladěné na instrukce jsou optimalizované pro vizuální rozpoznávání, obrazové uvažování, popisování obrázků a odpovídání na obecné otázky k obrázku.

  • Hostováno Cloudflare
  • LoRA
  • Vision
Logo Meta

llama-3.2-1b-instruct

MetaGenerování textu

Textové modely Llama 3.2 doladěné na instrukce jsou optimalizované pro vícejazyčné dialogové scénáře, včetně agentního vyhledávání a shrnování textu.

  • Hostováno Cloudflare
Logo Meta

llama-3.2-3b-instruct

MetaGenerování textu

Textové modely Llama 3.2 doladěné na instrukce jsou optimalizované pro vícejazyčné dialogové scénáře, včetně agentního vyhledávání a shrnování textu.

  • Hostováno Cloudflare
Logo Meta

llama-3.3-70b-instruct-fp8-fast

MetaGenerování textu

Llama 3.3 70B kvantovaná na přesnost fp8, optimalizovaná pro vyšší rychlost.

  • Hostováno Cloudflare
  • Batch
  • Volání funkcí
Logo Meta

llama-4-scout-17b-16e-instruct

MetaGenerování textu

Model Llama 4 Scout od Meta má 17 miliard parametrů a 16 expertů a je nativně multimodální. Tyto modely využívají architekturu mixture-of-experts a nabízejí špičkový výkon v porozumění textu i obrazu.

  • Hostováno Cloudflare
  • Batch
  • Volání funkcí
  • Vision
Logo Meta

llama-guard-3-8b

MetaGenerování textu

Llama Guard 3 je předtrénovaný model Llama-3.1-8B doladěný pro klasifikaci bezpečnosti obsahu. Podobně jako předchozí verze dokáže klasifikovat obsah jak na vstupu do LLM (klasifikace promptu), tak v odpovědích LLM (klasifikace odpovědi). Funguje jako LLM: na výstupu generuje text, který určuje, zda je daný prompt nebo odpověď bezpečná, nebo ne, a pokud není bezpečná, uvede také porušené kategorie obsahu.

  • Hostováno Cloudflare
  • LoRA

llava-1.5-7b-hf

Beta
llava-hfImage-to-Text

LLaVA je open-source chatbot natrénovaný doladěním LLaMA/Vicuna na multimodálních datech pro sledování instrukcí generovaných pomocí GPT. Jde o autoregresivní jazykový model založený na architektuře transformer.

  • Hostováno Cloudflare
Logo Leonardo

lucid-origin

LeonardoText-to-Image

Lucid Origin od Leonardo.AI je jejich zatím nejpřizpůsobivější model, který nejlépe reaguje na zadané prompty. Ať už generujete obrázky s ostrým grafickým designem, působivé rendery ve full HD, nebo potřebujete velmi specifické kreativní zadání, model se drží zadaného promptu, přesně vykresluje text a podporuje širokou škálu vizuálních stylů a estetik: od stylizovaného concept artu až po čisté product mockupy.

  • Hostováno Cloudflare
  • Partner
Logo Meta

m2m100-1.2b

MetaPřeklad

Vícejazyčný model typu encoder-decoder (seq-to-seq) trénovaný pro vícejazyčný překlad many-to-many

  • Hostováno Cloudflare
  • Batch
Logo MyShell

melotts

MyShellText-to-Speech

MeloTTS je vysoce kvalitní vícejazyčná knihovna pro převod textu na řeč od MyShell.ai.

  • Hostováno Cloudflare
Logo Meta

meta-llama-3-8b-instruct

MetaGenerování textu

S každou další generací dosahuje Meta Llama 3 špičkového výkonu v široké škále odvětvových benchmarků a nabízí nové možnosti, včetně vylepšeného uvažování.

  • Hostováno Cloudflare
  • Zastaralé
Logo MistralAI

mistral-7b-instruct-v0.1

MistralAIGenerování textu

Instrukcemi doladěná verze generativního textového modelu Mistral-7b se 7 miliardami parametrů

  • Hostováno Cloudflare
  • LoRA
  • Zastaralé
Logo MistralAI

mistral-7b-instruct-v0.2

Beta
MistralAIGenerování textu

Mistral-7B-Instruct-v0.2 je velký jazykový model (LLM), doladěná verze modelu Mistral-7B-v0.2 pro práci s instrukcemi. Oproti Mistral-7B-v0.1 přináší Mistral-7B-v0.2 tyto změny: kontextové okno 32k (místo 8k ve v0.1), rope-theta = 1e6 a bez Sliding-Window Attention.

  • Hostováno Cloudflare
  • LoRA
  • Zastaralé
Logo MistralAI

mistral-7b-instruct-v0.2-lora

Beta
MistralAIGenerování textu

Mistral-7B-Instruct-v0.2 je velký jazykový model (LLM), doladěná verze modelu Mistral-7B-v0.2 pro práci s instrukcemi.

  • Hostováno Cloudflare
  • LoRA
Logo MistralAI

mistral-small-3.1-24b-instruct

MistralAIGenerování textu

Mistral Small 3.1 (2503) navazuje na Mistral Small 3 (2501) a přidává nejmodernější porozumění obrazu spolu s vylepšenými schopnostmi dlouhého kontextu až do 128k tokenů, aniž by to omezilo výkon v textových úlohách. S 24 miliardami parametrů dosahuje tento model špičkových výsledků jak v textových, tak obrazových úlohách.

  • Hostováno Cloudflare
  • Volání funkcí

moondream3.1-9B-A2B

moondreamImage-to-Text

Moondream 3 je rychlý a efektivní vizuálně-jazykový model typu mixture-of-experts s 9B parametry (2B aktivních parametrů), který nabízí vizuální uvažování na špičkové úrovni pro úlohy jako detekce objektů, pointing, OCR a strukturovaný výstup.

  • Hostováno Cloudflare
  • Vision
Logo NVIDIA

nemotron-3-120b-a12b

NVIDIAGenerování textu

NVIDIA Nemotron 3 Super je hybridní model MoE se špičkovou přesností pro multiagentní aplikace a specializované agentické AI systémy.

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
Logo Deepgram

nova-3

DeepgramAutomatické rozpoznávání řeči

Přepis zvuku pomocí modelu Deepgram pro převod řeči na text

  • Hostováno Cloudflare
  • Batch
  • Partner
  • V reálném čase
Logo Microsoft

phi-2

Beta
MicrosoftGenerování textu

Phi-2 je model založený na architektuře Transformer s cílem predikovat další slovo, natrénovaný na 1.4T tokenů během několika průchodů směsí syntetických a webových datových sad pro NLP a programování.

  • Hostováno Cloudflare
  • Zastaralé
Logo Leonardo

phoenix-1.0

LeonardoText-to-Image

Phoenix 1.0 je model od Leonardo.Ai, který generuje obrázky s výjimečnou přesností podle promptu a souvislým textem.

  • Hostováno Cloudflare
  • Partner

plamo-embedding-1b

pfnetTextové embeddingy

PLaMo-Embedding-1B je japonský textový embedding model vyvinutý společností Preferred Networks, Inc. Dokáže převádět japonský textový vstup na číselné vektory a lze jej použít pro širokou škálu aplikací, včetně vyhledávání informací, klasifikace textu a shlukování.

  • Hostováno Cloudflare
Logo Qwen

qwen2.5-coder-32b-instruct

QwenGenerování textu

Qwen2.5-Coder je nejnovější řada velkých jazykových modelů Qwen zaměřených na kód (dříve známých jako CodeQwen). Qwen2.5-Coder v současnosti pokrývá šest hlavních velikostí modelů, 0.5, 1.5, 3, 7, 14 a 32 miliard parametrů, aby vyhověl potřebám různých vývojářů. Oproti CodeQwen1.5 přináší Qwen2.5-Coder následující vylepšení:

  • Hostováno Cloudflare
  • LoRA
Logo Qwen

qwen3-30b-a3b-fp8

QwenGenerování textu

Qwen3 je nejnovější generace velkých jazykových modelů řady Qwen, která nabízí ucelenou sadu hustých modelů i modelů typu mixture-of-experts (MoE). Díky rozsáhlému trénování přináší Qwen3 zásadní pokrok v uvažování, dodržování instrukcí, schopnostech agentů a podpoře více jazyků.

  • Hostováno Cloudflare
  • Batch
  • Volání funkcí
  • Uvažování
Logo Qwen

qwen3-embedding-0.6b

QwenTextové embeddingy

Řada modelů Qwen3 Embedding je nejnovější proprietární model rodiny Qwen, navržený speciálně pro embedding textu a řazení podle relevance.

  • Hostováno Cloudflare
Logo Qwen

qwen3.8-27b

QwenImage-Text-to-Text

Qwen 3.8 27B je jazykový model se 27 miliardami parametrů doladěný na instrukce z rodiny Qwen od společnosti Alibaba, určený pro vidění, efektivní obecné generování textu a agentní úlohy.

  • Hostováno Cloudflare
  • Volání funkcí
  • Uvažování
  • Vision
Logo Qwen

qwq-32b

QwenGenerování textu

QwQ je model pro uvažování z řady Qwen. Ve srovnání s běžnými modely doladěnými na instrukce dokáže QwQ, který je schopen přemýšlet a uvažovat, dosáhnout výrazně lepšího výkonu v navazujících úlohách, zejména u těžkých problémů. QwQ-32B je středně velký model pro uvažování, který dokáže dosahovat konkurenceschopného výkonu ve srovnání se špičkovými modely pro uvažování, například DeepSeek-R1 nebo o1-mini.

  • Hostováno Cloudflare
  • LoRA
  • Uvažování
Logo Microsoft

resnet-50

MicrosoftKlasifikace obrázků

CNN pro klasifikaci obrázků s hloubkou 50 vrstev, natrénovaná na více než 1M obrázků z ImageNetu

  • Hostováno Cloudflare
Logo Pipecat

smart-turn-v2

PipecatDetekce hlasové aktivity

Open source model s podporou komunity pro nativní detekci střídání mluvčích ve zvuku, druhá verze

  • Hostováno Cloudflare
  • Batch
  • V reálném čase
Logo Defog

sqlcoder-7b-2

Beta
DefogGenerování textu

Tento model je určen netechnickým uživatelům, aby jim pomohl porozumět datům v jejich SQL databázích.

  • Hostováno Cloudflare
  • Zastaralé
Logo RunwayML

stable-diffusion-v1-5-img2img

Beta
RunwayMLText-to-Image

Stable Diffusion je latentní difuzní model pro generování obrázků z textu, který dokáže vytvářet fotorealistické obrázky. Img2img vygeneruje pomocí Stable Diffusion nový obrázek ze vstupního obrázku.

  • Hostováno Cloudflare
Logo RunwayML

stable-diffusion-v1-5-inpainting

Beta
RunwayMLText-to-Image

Stable Diffusion Inpainting je latentní difuzní model pro generování obrázků z textu, který dokáže vytvářet fotorealistické obrázky na základě libovolného textového vstupu a navíc umí pomocí masky domalovat části obrázku.

  • Hostováno Cloudflare
Logo Stability.ai

stable-diffusion-xl-base-1.0

Beta
Stability.aiText-to-Image

Generativní model pro převod textu na obraz od společnosti Stability AI založený na difúzi. Vytváří a upravuje obrázky na základě textových promptů.

  • Hostováno Cloudflare
Logo ByteDance

stable-diffusion-xl-lightning

Beta
ByteDanceText-to-Image

SDXL-Lightning je bleskově rychlý model pro generování obrázků z textu. Dokáže vytvořit kvalitní obrázky o rozlišení 1024px během několika kroků.

  • Hostováno Cloudflare
Logo Unum

uform-gen2-qwen-500m

Beta
UnumImage-to-Text

UForm-Gen je malý generativní vizuálně-jazykový model určený především pro popisování obrázků a zodpovídání vizuálních otázek. Model byl předtrénován na interní datové sadě pro popisování obrázků a doladěn na veřejných instrukčních datových sadách: SVIT, LVIS a VQAs.

  • Hostováno Cloudflare
  • Zastaralé
Logo OpenAI

whisper

OpenAIAutomatické rozpoznávání řeči

Whisper je univerzální model pro rozpoznávání řeči. Je natrénován na rozsáhlé sadě různorodých zvukových dat a jedná se zároveň o multitaskový model, který umí vícejazyčné rozpoznávání řeči, překlad řeči a identifikaci jazyka.

  • Hostováno Cloudflare
Logo OpenAI

whisper-large-v3-turbo

OpenAIAutomatické rozpoznávání řeči

Whisper je předtrénovaný model pro automatické rozpoznávání řeči (ASR) a překlad řeči.

  • Hostováno Cloudflare
  • Batch
Logo OpenAI

whisper-tiny-en

Beta
OpenAIAutomatické rozpoznávání řeči

Whisper je předtrénovaný model pro automatické rozpoznávání řeči (ASR) a překlad řeči. Modely Whisper jsou natrénovány na 680k hodinách označkovaných dat a vykazují silnou schopnost generalizovat na mnoho různých datových sad a domén bez nutnosti doladění. Toto je anglická verze modelu Whisper Tiny, natrénovaná na úlohu rozpoznávání řeči.

  • Hostováno Cloudflare