{"models":[{"endpoint_id":"fal-ai/nano-banana-2/edit","metadata":{"display_name":"Nano Banana 2","category":"image-to-image","description":"Nano Banana 2 is Google's new state-of-the-art image generation and editing model\n","status":"active","tags":[],"updated_at":"2026-08-19T19:54:05.061Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a900b75/DHb_RgXoXsYLdvzQz6mdn_95e87a44239c43448939b4c382dd957c.jpg","model_url":"https://fal.run/fal-ai/nano-banana-2/edit","license_type":"commercial","date":"2026-02-26T16:20:09.685Z","group":{"key":"nano-banana-2","label":"Image Editing"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/nano-banana-pro/edit","metadata":{"display_name":"Nano Banana Pro","category":"image-to-image","description":"Nano Banana Pro is Google's new state-of-the-art image generation and editing model","status":"active","tags":["realism","typography"],"updated_at":"2026-06-18T17:13:56.639Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9c2f0f/p3rXI18zMYTBz1M0qP2h4_b9a2087ce0b64cd788cb5ec067edc26e.jpg","model_url":"https://fal.run/fal-ai/nano-banana-pro/edit","license_type":"commercial","date":"2025-11-20T14:27:03.344Z","group":{"key":"Nano-Banana-Pro","label":"Image Editing"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"openai/gpt-image-2/edit","metadata":{"display_name":"GPT Image 2 API","category":"image-to-image","description":"GPT Image 2, OpenAI's latest image model, is capable of making fine-grained, detailed edits to images.","status":"active","tags":["gpt-image-2","openai","chatgpt-images-2"],"updated_at":"2026-08-13T21:01:03.124Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9c2f0d/G7gs81xziNgfaucyi7NO7_cfb3919cd2914dfba679e44ce8bbecdc.jpg","model_url":"https://fal.run/openai/gpt-image-2/edit","license_type":"commercial","date":"2026-04-20T19:16:13.451Z","group":{"key":"gpt-image-2","label":"Edit"},"highlighted":false,"kind":"inference","stream_url":"https://fal.run/openai/gpt-image-2/edit/stream","pinned":false}},{"endpoint_id":"fal-ai/flux/schnell","metadata":{"display_name":"FLUX.1 [schnell]","category":"text-to-image","description":"FLUX.1 [schnell] is a 12 billion parameter flow transformer that generates high-quality images from text in 1 to 4 steps, suitable for personal and commercial use.","status":"active","tags":[],"updated_at":"2026-06-24T23:02:10.109Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9af64d/GxvCUPd3gO-MSYcy06g0x_1641cfe028c2429b8e12e4fc320eb0a8.jpg","model_url":"https://fal.run/fal-ai/flux/schnell","github_url":"https://www.apache.org/licenses/LICENSE-2.0.txt","license_type":"commercial","date":"2024-11-25T00:00:00.000Z","group":{"key":"flux-1","label":"Text to Image [schnell]"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"openai/gpt-image-2.5/sunburst/edit","metadata":{"display_name":"GPT Image 2.5 Sunburst Edit ","category":"image-to-image","description":"Editing built for the tightest control, edits scoped precisely to the instruction, with subject and composition preserved across many rounds of revision.","status":"active","tags":["stylized","transform","editing"],"updated_at":"2026-09-11T19:34:21.150Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa9a3b8/cSrDjg-ke-PcqgHiY_gxn.jpg","model_url":"https://fal.run/openai/gpt-image-2.5/sunburst/edit","license_type":"commercial","date":"2026-09-08T19:43:14.655Z","group":{"key":"gpt-25","label":"Image Editing Sunburst"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/nano-banana-2","metadata":{"display_name":"Nano Banana 2","category":"text-to-image","description":"Nano Banana 2 is Google's new state-of-the-art fast image generation and editing model","status":"active","tags":[],"updated_at":"2026-06-11T00:04:55.093Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a900b9e/ptbZcVWIQ_fXGGHfv8Zez_0ea5ca41bdf143a29e21e30a53120672.jpg","model_url":"https://fal.run/fal-ai/nano-banana-2","license_type":"commercial","date":"2026-02-26T16:08:01.361Z","group":{"key":"nano-banana-2","label":"Text to Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"openai/gpt-image-2","metadata":{"display_name":"GPT Image 2 API","category":"text-to-image","description":"GPT Image 2, OpenAI's latest image model, is capable of creating extremely detailed images with fine typography.","status":"active","tags":["gpt-image-2","openai","typography","chatgpt-images-2"],"updated_at":"2026-09-01T17:33:00.839Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a970c4a/BkrYELYOiaZMXCw-pgRcB_QlgOenEx.png","model_url":"https://fal.run/openai/gpt-image-2","license_type":"commercial","date":"2026-04-20T19:16:42.065Z","group":{"key":"gpt-image-2","label":"Text to Image"},"highlighted":false,"kind":"inference","stream_url":"https://fal.run/openai/gpt-image-2/stream","pinned":false}},{"endpoint_id":"minimax/h3-max/image-to-video","metadata":{"display_name":"H3 Max Image to Video","category":"image-to-video","description":"fal's H3 Max is a post-trained variant of MiniMax H3, tuned for stronger prompt adherence and better aesthetics while co-optimized with our custom inference stack for higher throughput with no compromises on output quality","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-09-08T23:20:10.422Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa7658f/fSQlWMcduHn4_abgJ7qhQ.jpg","model_url":"https://fal.run/minimax/h3-max/image-to-video","license_type":"commercial","date":"2026-08-23T18:01:01.388Z","group":{"key":"hailuo-03-new-turbo","label":"Image to Video Max"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/nano-banana-pro","metadata":{"display_name":"Nano Banana Pro","category":"text-to-image","description":"Nano Banana Pro is Google's new state-of-the-art image generation and editing model","status":"active","tags":["realism","typography"],"updated_at":"2026-04-28T16:29:09.509Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8691ce/SR0_u1zPJbx8jCIO6bJR0_8c83f0d66bbd48f3b55f825117941f84.jpg","model_url":"https://fal.run/fal-ai/nano-banana-pro","license_type":"commercial","date":"2025-11-20T14:24:45.001Z","group":{"key":"Nano-Banana-Pro","label":"Text to Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"openai/gpt-image-2.5/flare/edit","metadata":{"display_name":"GPT Image 2.5 Flare Edit","category":"image-to-image","description":"Precise image editing that changes only what's asked, keeping subject, composition, and background intact, with reference subjects staying recognizable across styles and successive edits.","status":"active","tags":["stylized","transform","editing"],"updated_at":"2026-09-11T19:34:21.150Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa9a3a4/LkWSlm_4F_SXsNlc4limv.jpg","model_url":"https://fal.run/openai/gpt-image-2.5/flare/edit","license_type":"commercial","date":"2026-09-08T19:39:52.983Z","group":{"key":"gpt-25","label":"Image Editing Flare"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/flux/dev","metadata":{"display_name":"FLUX.1 [dev]","category":"text-to-image","description":"FLUX.1 [dev] is a 12 billion parameter flow transformer that generates high-quality images from text. It is suitable for personal and commercial use.","status":"active","tags":[],"updated_at":"2026-04-21T17:47:32.206Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/fal_cdn/fal/Upscale-1.jpeg","model_url":"https://fal.run/fal-ai/flux/dev","license_type":"commercial","date":"2025-04-01T18:10:42.284Z","group":{"key":"flux-1","label":"Text to Image [dev]"},"highlighted":false,"kind":"inference","stream_url":"https://fal.run/fal-ai/flux/dev/stream","pinned":false}},{"endpoint_id":"fal-ai/nano-banana/edit","metadata":{"display_name":"Nano Banana","category":"image-to-image","description":"Google's famous original image generation and editing model","status":"active","tags":["image-editing"],"updated_at":"2026-06-26T20:56:24.634Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9f9a4a/mjFnPPGaaBaf5OHrDSoSO_ns4MA9ac.png","model_url":"https://fal.run/fal-ai/nano-banana/edit","license_type":"commercial","date":"2025-08-19T22:16:18.949Z","group":{"key":"nano-banana","label":"Image Editing"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/kling-video/v3/pro/image-to-video","metadata":{"display_name":"Kling Video v3 Image to Video [Pro]","category":"image-to-video","description":"Kling 3.0 Pro: Top-tier image-to-video with cinematic visuals, fluid motion, and native audio generation, with custom element support.","status":"active","tags":["image-to-video"],"updated_at":"2026-05-29T18:50:02.672Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9c2fb3/yPzcdzINnY5RdSoEqHc8G_382d4ec9337344ccaacf5599057f6cd0.jpg","model_url":"https://fal.run/fal-ai/kling-video/v3/pro/image-to-video","license_type":"commercial","date":"2026-02-04T15:48:44.935Z","group":{"key":"kling-v3","label":"Image to Video (pro)"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"minimax/h3-max-turbo/image-to-video","metadata":{"display_name":"H3 Max Turbo Image to Video","category":"image-to-video","description":"fal's H3 Max Turbo is a post-trained variant of MiniMax H3, tuned for stronger prompt adherence and better aesthetics while co-optimized with our custom inference stack for higher throughput with no compromises on output quality","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-09-08T23:20:10.422Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa8d532/tsMg9lPG9DaXI7bqzqz6Y.jpg","model_url":"https://fal.run/minimax/h3-max-turbo/image-to-video","license_type":"commercial","date":"2026-09-02T16:51:51.105Z","group":{"key":"hailuo-03-new-max-turbo","label":"Image to Video Max Turbo"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"minimax/h3-max/reference-to-video","metadata":{"display_name":"H3 Max Reference to Video","category":"image-to-video","description":"fal's H3 Max is a post-trained variant of MiniMax H3, tuned for stronger prompt adherence and better aesthetics while co-optimized with our custom inference stack for higher throughput with no compromises on output quality","status":"active","tags":["stylized","transform","typography"],"updated_at":"2026-09-08T23:20:10.422Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa84d7e/Weqd1RIL2EmDlzxnkQzCq.jpg","model_url":"https://fal.run/minimax/h3-max/reference-to-video","license_type":"commercial","date":"2026-08-29T16:21:32.325Z","group":{"key":"hailuo-03-new-turbo","label":"Reference to Video Max"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"openai/gpt-image-2.5/sunburst/text-to-image","metadata":{"display_name":"GPT Image 2.5 Sunburst Text to Image","category":"text-to-image","description":"OpenAI's precision-focused image model, built for premium visual work, extra fidelity on intricate detail, in exchange for longer generation times.","status":"active","tags":["realism","typography","stylized"],"updated_at":"2026-09-11T19:34:21.150Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa9a3c6/xpKm5FzsZBuvm2Bf8xY7W.jpg","model_url":"https://fal.run/openai/gpt-image-2.5/sunburst/text-to-image","license_type":"commercial","date":"2026-09-08T19:41:24.961Z","group":{"key":"gpt-25","label":"Text to Image Sunburst"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"openai/gpt-image-2.5/flare/text-to-image","metadata":{"display_name":"GPT Image 2.5 Flare Text to Image","category":"text-to-image","description":"OpenAI's default image model for most applications. Fast, high-quality generation with natural lighting, rich textures, and support for complex layouts including transparent backgrounds.","status":"active","tags":["realism","typography","stylized"],"updated_at":"2026-09-11T19:34:21.150Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa9a39a/1RpGwGDfDZbwC_QBhudJo.jpg","model_url":"https://fal.run/openai/gpt-image-2.5/flare/text-to-image","license_type":"commercial","date":"2026-09-08T19:38:25.222Z","group":{"key":"gpt-25","label":"Text to Image Flare"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/birefnet/v2","metadata":{"display_name":"Birefnet Background Removal V2","category":"image-to-image","description":"bilateral reference framework (BiRefNet) for high-resolution dichotomous image segmentation (DIS)","status":"active","tags":["background removal","segmentation","high-res","utility"],"updated_at":"2026-07-10T21:29:33.954Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/falserverless/gallery/birefnet.webp","thumbnail_animated_url":"https://storage.googleapis.com/falserverless/gallery/birefnet-animated.webp","model_url":"https://fal.run/fal-ai/birefnet/v2","license_type":"commercial","date":"2024-10-28T00:00:00.000Z","highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"bytedance/seedream/v5/pro/edit","metadata":{"display_name":"Seedream 5.0 Pro Image Editing","category":"image-to-image","description":"Seedream 5.0 Pro is grounded, region-precise image editing model that changes one element while keeping the rest of the frame intact with layer separation, sketch completion, and up to 10 reference images.","status":"active","tags":["realism","typography","stylized"],"updated_at":"2026-07-17T03:47:17.078Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa15606/l4xYHHjF6aMrdoonScgXK.jpg","model_url":"https://fal.run/bytedance/seedream/v5/pro/edit","license_type":"commercial","date":"2026-07-07T20:08:05.177Z","group":{"key":"seedream-5-pro","label":"Image Editing"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"bytedance/seedance-2.5/reference-to-video","metadata":{"display_name":"Seedance 2.5 Reference to Video","category":"image-to-video","description":"Dreamina Seedance 2.5 generates video from up to 50 multimodal references images, video, audio, and style inputs, locking a character, set, and palette across a full 30-second take for production-grade consistency.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-09-09T17:43:56.710Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa30ee1/AvoWQSXcqJuX5CggoM3uh.jpg","model_url":"https://fal.run/bytedance/seedance-2.5/reference-to-video","license_type":"commercial","date":"2026-07-20T21:04:34.821Z","group":{"key":"Seedance-25","label":"Reference to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/flux-2-pro","metadata":{"display_name":"Flux 2 Pro","category":"text-to-image","description":"Image editing with FLUX.2 [pro] from Black Forest Labs. Ideal for high-quality image manipulation, style transfer, and sequential editing workflows","status":"active","tags":[],"updated_at":"2026-04-21T17:46:42.940Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/penguin/UfryXXm9my6IM8HsoP9FL_054c2c2953dc491996904114c6e04836.jpg","model_url":"https://fal.run/fal-ai/flux-2-pro","license_type":"commercial","date":"2025-11-23T00:14:31.608Z","group":{"key":"Flux2-Pro","label":"Text to Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"minimax/h3-max/text-to-video","metadata":{"display_name":"MiniMax H3 Max Text to Video","category":"text-to-video","description":"fal's H3 Max is a post-trained variant of MiniMax H3, tuned for stronger prompt adherence and better aesthetics while co-optimized with our custom inference stack for higher throughput with no compromises on output quality","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-09-08T23:20:10.422Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa7657e/LlavC7cCdZ_GGyvyglA82.jpg","model_url":"https://fal.run/minimax/h3-max/text-to-video","license_type":"commercial","date":"2026-08-23T17:56:01.222Z","group":{"key":"hailuo-03-new-turbo","label":"Text to Video Max"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"bytedance/seedance-2.5/image-to-video","metadata":{"display_name":"Seedance 2.5 Image to Video","category":"image-to-video","description":"Dreamina Seedance 2.5 animates a single still into a native 30-second clip at up to 720p, extending one frame into continuous, coherent motion without the drift or stitching of shorter multi-clip workflows.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-08-28T18:46:17.166Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa30ef9/4Ux9T9X2458w7LH1AI_oz.jpg","model_url":"https://fal.run/bytedance/seedance-2.5/image-to-video","license_type":"commercial","date":"2026-07-20T21:02:38.001Z","group":{"key":"Seedance-25","label":"Image to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/nano-banana","metadata":{"display_name":"Nano Banana","category":"text-to-image","description":"Google's famous original image generation and editing model","status":"active","tags":["image-generation"],"updated_at":"2026-06-24T10:31:30.626Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9f91a7/UOFMBU7hW6hqvFYvXHH-o_MZBJlwLt.png","model_url":"https://fal.run/fal-ai/nano-banana","license_type":"commercial","date":"2025-08-19T22:11:04.357Z","group":{"key":"nano-banana","label":"Text to Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/flux-pro/kontext","metadata":{"display_name":"FLUX.1 Kontext [pro]","category":"image-to-image","description":"FLUX.1 Kontext [pro] handles both text and reference images as inputs, seamlessly enabling targeted, local edits and complex transformations of entire scenes.","status":"active","tags":[],"updated_at":"2026-04-21T17:47:19.221Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/fal_cdn/fal/Training-2.jpg","model_url":"https://fal.run/fal-ai/flux-pro/kontext","license_type":"commercial","date":"2025-05-28T18:30:52.718Z","group":{"key":"flux-pro-kontext","label":"Kontext [pro] -- Editing"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/flux-pro/v1.1","metadata":{"display_name":"FLUX1.1 [pro]","category":"text-to-image","description":"FLUX1.1 [pro] is an enhanced version of FLUX.1 [pro], improved image generation capabilities, delivering superior composition, detail, and artistic fidelity compared to its predecessor.","status":"active","tags":[],"updated_at":"2026-04-21T17:47:23.571Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/falserverless/gallery/turbo_thumbnail.jpg","model_url":"https://fal.run/fal-ai/flux-pro/v1.1","license_type":"commercial","date":"2025-01-16T00:00:00.000Z","group":{"key":"flux-pro","label":"FLUX 1.1 [pro]"},"highlighted":false,"pinned":false}},{"endpoint_id":"fal-ai/bytedance/seedream/v4.5/edit","metadata":{"display_name":"Bytedance Seedream V4.5 Edit","category":"image-to-image","description":"A new-generation image creation model ByteDance, Seedream 4.5 integrates image generation and image editing capabilities into a single, unified architecture.\n","status":"active","tags":["stylized","transform"],"updated_at":"2026-04-26T21:58:12.077Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a84910b/lDvWLqpxcFmzQHdadDA7t_4012f28b4f79444782d90d8927b42c29.jpg","model_url":"https://fal.run/fal-ai/bytedance/seedream/v4.5/edit","license_type":"commercial","date":"2025-12-03T10:44:48.263Z","group":{"key":"Seedream45","label":"Image Editing"},"highlighted":false,"kind":"inference","duration_estimate":1,"pinned":false}},{"endpoint_id":"fal-ai/kling-video/v2.5-turbo/pro/image-to-video","metadata":{"display_name":"Kling Video","category":"image-to-video","description":"Kling 2.5 Turbo Pro: Top-tier image-to-video generation with unparalleled motion fluidity, cinematic visuals, and exceptional prompt precision.","status":"active","tags":["stylized","transform"],"updated_at":"2026-04-26T22:25:17.147Z","is_favorited":null,"thumbnail_url":"https://v3.fal.media/files/rabbit/2KNBk1qkmEBXK0FLgfHCl_ee4bb1ada254433bbab296893a8636e3.jpg","model_url":"https://fal.run/fal-ai/kling-video/v2.5-turbo/pro/image-to-video","license_type":"commercial","date":"2025-09-22T22:51:16.379Z","group":{"key":"kling-video-v25","label":"2.5 Turbo (Image to Video) Pro"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/flux-2-pro/edit","metadata":{"display_name":"FLUX 2 Pro Edit","category":"image-to-image","description":"Text-to-image generation with FLUX.2 [pro] from Black Forest Labs. Optimized for maximum quality, exceptional photorealism and artistic images.","status":"active","tags":[],"updated_at":"2026-04-21T17:46:43.441Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/penguin/eZetcrsZI6AQLCD3f5gaI_b173ae004bdd4108bd1be54eb6e49c7a.jpg","model_url":"https://fal.run/fal-ai/flux-2-pro/edit","license_type":"commercial","date":"2025-11-23T00:13:41.404Z","group":{"key":"Flux2-Pro","label":"Image Editing"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"bytedance/seedream/v5/pro/text-to-image","metadata":{"display_name":"Seedream 5.0 Pro Text to Image","category":"text-to-image","description":"ByteDance's Seedream 5.0 Pro is flagship text-to-image model, with deep-thinking prompt understanding, native text in 14 languages, and precise control over dense layouts and structured designs.","status":"active","tags":["realism","typography","stylized"],"updated_at":"2026-07-17T03:49:00.715Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa1561a/Rb0DDLUI2sx4gevoh1HKt.jpg","model_url":"https://fal.run/bytedance/seedream/v5/pro/text-to-image","license_type":"commercial","date":"2026-07-07T20:10:11.334Z","group":{"key":"seedream-5-pro","label":"Text to Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/seedvr/upscale/image","metadata":{"display_name":"SeedVR2","category":"image-to-image","description":"Use SeedVR2 to upscale your images","status":"active","tags":["upscale","image-to-image"],"updated_at":"2026-05-26T23:37:45.620Z","is_favorited":null,"thumbnail_url":"https://v3.fal.media/files/panda/_-1rRy0_I6w-fbt3q0RDL_2f47fece6e2b433994dda482e8d20bb9.jpg","model_url":"https://fal.run/fal-ai/seedvr/upscale/image","license_type":"commercial","date":"2025-09-22T18:19:28.476Z","group":{"key":"seedvr2","label":"Upscale Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/kling-video/v3/standard/image-to-video","metadata":{"display_name":"Kling Video v3 Image to Video [Standard]","category":"image-to-video","description":"Kling 3.0 Standard: Top-tier image-to-video with cinematic visuals, fluid motion, and native audio generation, with custom element support.","status":"active","tags":["image-to-video"],"updated_at":"2026-04-26T22:25:17.147Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8cfcdb/TywpxxNj5_vDG8AUw3Yum_e2172b5c00e64a91a434ab5a38e496f0.jpg","model_url":"https://fal.run/fal-ai/kling-video/v3/standard/image-to-video","license_type":"commercial","date":"2026-02-04T15:48:44.935Z","group":{"key":"kling-v3","label":"Image To Video (standard)"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/elevenlabs/tts/eleven-v3","metadata":{"display_name":"Elevenlabs Tts Eleven V3","category":"text-to-audio","description":"Generate text-to-speech audio using Eleven-v3 from ElevenLabs.","status":"active","tags":["audio"],"updated_at":"2026-06-24T10:32:10.977Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9f91a8/oTkavdBnqhpPaT65B3FG8_euEcQphX.png","model_url":"https://fal.run/fal-ai/elevenlabs/tts/eleven-v3","license_type":"commercial","date":"2025-08-20T19:22:36.745Z","highlighted":false,"kind":"inference","stream_url":"https://fal.run/fal-ai/elevenlabs/tts/eleven-v3/stream","pinned":false}},{"endpoint_id":"minimax/h3-max-turbo/text-to-video","metadata":{"display_name":"H3 Max Turbo Text to Video","category":"text-to-video","description":"fal's H3 Max Turbo is a post-trained variant of MiniMax H3, tuned for stronger prompt adherence and better aesthetics while co-optimized with our custom inference stack for higher throughput with no compromises on output quality","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-09-08T23:20:10.422Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa8d50b/vj4BiCoQwOlmK7ku4KBZq.jpg","model_url":"https://fal.run/minimax/h3-max-turbo/text-to-video","license_type":"commercial","date":"2026-09-02T16:44:59.129Z","group":{"key":"hailuo-03-new-max-turbo","label":"Text to Video Max Turbo"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/bria/background/remove","metadata":{"display_name":"Bria RMBG 2.0","category":"image-to-image","description":"Bria RMBG 2.0 enables seamless removal of backgrounds from images, ideal for professional editing tasks. Trained exclusively on licensed data for safe and risk-free commercial use. Model weights for commercial use are available here: https://share-eu1.hsforms.com/2GLpEVQqJTI2Lj7AMYwgfIwf4e04","status":"active","tags":["background removal","image segmentation","high resolution","utility","rembg"],"updated_at":"2026-06-24T10:32:00.775Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9f91b0/MLLgU8RVRvmMXjLkFNHwH_DWC4dcir.png","model_url":"https://fal.run/fal-ai/bria/background/remove","license_type":"commercial","date":"2024-12-19T00:00:00.000Z","group":{"key":"bria","label":"Remove Background"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"minimax/h3/reference-to-video","metadata":{"display_name":"MiniMax H3 Reference to Video","category":"image-to-video","description":"MiniMax H3 is a frontier video model. This endpoint generates 2K video from multimodal references up to 9 images for subject and style, 3 video clips for motion, and 3 audio clips each cited in the prompt by order, keeping subjects consistent while following the referenced motion and audio.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-08-25T17:41:07.462Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa42dcf/3VDKabd7ifjCezrQpdfEI.jpg","model_url":"https://fal.run/minimax/h3/reference-to-video","license_type":"commercial","date":"2026-07-31T05:55:07.987Z","group":{"key":"hailuo-03-new","label":"Reference to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/flux-pro/v1.1-ultra","metadata":{"display_name":"FLUX1.1 [pro] ultra","category":"text-to-image","description":"FLUX1.1 [pro] ultra is the newest version of FLUX1.1 [pro], maintaining professional-grade image quality while delivering up to 2K resolution with improved photo realism.","status":"active","tags":["high-res","realism"],"updated_at":"2026-04-21T17:47:24.374Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/falserverless/gallery/flux-pro-v1-1-ultra.webp","model_url":"https://fal.run/fal-ai/flux-pro/v1.1-ultra","license_type":"commercial","date":"2024-12-17T00:00:00.000Z","group":{"key":"flux-pro","label":"FLUX 1.1 [pro] (ultra)"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"bytedance/seedance-2.0/image-to-video","metadata":{"display_name":"Seedance 2 Image to Video","category":"image-to-video","description":"ByteDance's most advanced image-to-video model. Animate still images into cinematic video with synchronized audio, start and end frame control, and motion prompts.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-06-22T18:20:04.465Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9c2f2b/C5HNQz1oux7K-6Tqfd_-9_c4a7c912a6db402686fe2c01591a1687.jpg","model_url":"https://fal.run/bytedance/seedance-2.0/image-to-video","license_type":"commercial","date":"2026-04-01T18:47:20.614Z","group":{"key":"seedance-2.0-fal","label":"Image to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"bytedance/seedance-2.0/reference-to-video","metadata":{"display_name":"Seedance 2 Reference to Video","category":"image-to-video","description":"ByteDance's most advanced reference-to-video model. Generate video from up to 9 images, 3 videos, and 3 audio clips with native audio and cinematic camera control.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-07-01T20:49:35.883Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9c2f1a/nie2992p9QXZaJbgszHZY_d584fa3e77b44d57a33417a48fac06ab.jpg","model_url":"https://fal.run/bytedance/seedance-2.0/reference-to-video","license_type":"commercial","date":"2026-04-01T18:48:22.239Z","group":{"key":"seedance-2.0-fal","label":"Reference to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"google/nano-banana-2-lite","metadata":{"display_name":"Nano Banana 2 Lite","category":"text-to-image","description":"Nano banana lite is the efficiency-focused model in the image generation family. Sub-2 second latency with cost-effective generation and editing, fast multi-turn local edits, and 14 supported aspect ratios.","status":"active","tags":[],"updated_at":"2026-08-19T21:49:37.630Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa065ef/5nRcoeLuJhcbIysKu4EDf.jpg","model_url":"https://fal.run/google/nano-banana-2-lite","license_type":"commercial","date":"2026-06-30T19:22:41.518Z","group":{"key":"nano-banana-lite","label":"Text to Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/flux-2/klein/9b","metadata":{"display_name":"FLUX.2 [klein] 9B","category":"text-to-image","description":"Text-to-image generation with FLUX.2 [klein] 9B from Black Forest Labs. Enhanced realism, crisper text generation, and native editing capabilities.","status":"active","tags":[],"updated_at":"2026-07-09T03:35:23.028Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8a7f3c/90FKDpwtSCZTqOu0jUI-V_64c1a6ec0f9343908d9efa61b7f2444b.jpg","model_url":"https://fal.run/fal-ai/flux-2/klein/9b","license_type":"commercial","date":"2026-01-15T12:24:18.909Z","group":{"key":"klein","label":"9B Text to Image"},"highlighted":false,"kind":"inference","stream_url":"https://fal.ai/models/fal-ai/flux-2/klein/9b/stream","pinned":false}},{"endpoint_id":"openrouter/router/vision","metadata":{"display_name":"OpenRouter [Vision]","category":"vision","description":"Run any Vision Language Model with fal. Analyze and understand images using Claude (Anthropic), GPT-5 / GPT-4o (OpenAI), Gemini (Google), Grok (xAI), Llama (Meta), Qwen, Pixtral (Mistral), and more. Send one or multiple images for captioning, analysis, OCR, or visual Q&A. Powered by OpenRouter. ","status":"active","tags":[],"updated_at":"2026-06-26T15:54:21.304Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/penguin/v-wl5CGbHxNVatcGXntIY_e14c7922d88348769a90469d1c206501.jpg","model_url":"https://fal.run/openrouter/router/vision","license_type":"commercial","date":"2025-11-12T20:20:52.668Z","group":{"key":"openrouter/router","label":"Any VLM"},"highlighted":false,"kind":"inference","stream_url":"https://fal.run/openrouter/router/vision/stream","pinned":false}},{"endpoint_id":"fal-ai/kling-video/v2.6/pro/image-to-video","metadata":{"display_name":"Kling Video v2.6 Image to Video","category":"image-to-video","description":"Kling 2.6 Pro: Top-tier image-to-video with cinematic visuals, fluid motion, and native audio generation.","status":"active","tags":[],"updated_at":"2026-07-21T18:22:42.212Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a84aa9c/tRb6fibztV71jrhSPfdqP_3359db6ee74a4e4e9fb408a00b02e114.jpg","model_url":"https://fal.run/fal-ai/kling-video/v2.6/pro/image-to-video","license_type":"commercial","date":"2025-12-02T09:01:46.898Z","group":{"key":"kling-video/v2.6","label":"Image to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"bytedance/seedance-2.5/text-to-video","metadata":{"display_name":"Seedance 2.5 Text to Video","category":"text-to-video","description":"Dreamina Seedance 2.5 generates native 30-second single-shot video at up to 720p from a single text prompt, reasoning about the whole shot at once so motion, lighting, and subject identity stay coherent from first frame to last.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-08-28T18:45:54.815Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa30edb/Ckq9fPYW5fP_nqcCC-SHh.jpg","model_url":"https://fal.run/bytedance/seedance-2.5/text-to-video","license_type":"commercial","date":"2026-07-20T21:03:22.667Z","group":{"key":"Seedance-25","label":"Text to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"openrouter/router/openai/v1/chat/completions","metadata":{"display_name":"OpenRouter Chat Completions [OpenAI Compatible]","category":"llm","description":"OpenAI-compatible chat completions API. Drop-in replacement for the OpenAI API — use any OpenAI SDK or client to access Claude, Gemini, Grok, DeepSeek, Llama, Qwen, Mistral, and all OpenAI models (GPT-5, GPT-4o, o3) through fal. Powered by OpenRouter.","status":"active","tags":[],"updated_at":"2026-05-06T21:21:33.117Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/kangaroo/tll4XzKQE4bopYdZOX1q2_c3e4d28642484971932f8dbe3523af5a.jpg","model_url":"https://fal.run/openrouter/router/openai/v1/chat/completions","license_type":"commercial","date":"2025-11-12T20:15:52.898Z","group":{"key":"openrouter/router","label":"Chat Completions [OpenAI Compatible]"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"xai/grok-imagine-image/edit","metadata":{"display_name":"Grok Imagine Image","category":"image-to-image","description":"Edit images precisely with xAI's Grok Imagine model","status":"active","tags":["grok","xai","image-editing"],"updated_at":"2026-04-26T22:32:05.599Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8a0dc7/kv2XmZ5em8Kb2-7oXZndp_b897f79cbc564e1d8f4e5d5c71710c2b.jpg","model_url":"https://fal.run/xai/grok-imagine-image/edit","license_type":"commercial","date":"2026-01-29T00:29:41.002Z","group":{"key":"grok-imagine-image","label":"Edit Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/z-image/turbo","metadata":{"display_name":"Z Image Turbo","category":"text-to-image","description":"Z-Image Turbo is a super fast text-to-image model of 6B parameters developed by Tongyi-MAI.","status":"active","tags":["turbo","z-image","fast"],"updated_at":"2026-07-09T03:35:06.702Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/koala/Pvji5sM6n6oNIo-p0Xsn__245f3d4eb5df4952aa80ec74f4afd7f2.jpg","model_url":"https://fal.run/fal-ai/z-image/turbo","license_type":"commercial","date":"2025-11-26T14:38:10.381Z","group":{"key":"z-image-turbo","label":"Text to Image"},"highlighted":false,"kind":"inference","pinned":false,"training_endpoint_ids":["fal-ai/z-image-trainer","fal-ai/z-image-turbo-trainer-v2"]}},{"endpoint_id":"fal-ai/bytedance/seedream/v4/edit","metadata":{"display_name":"Bytedance Seedream V4 Edit","category":"image-to-image","description":"A new-generation image creation model ByteDance, Seedream 4.0 integrates image generation and image editing capabilities into a single, unified architecture.","status":"active","tags":["stylized","transform","editing"],"updated_at":"2026-04-26T21:58:12.077Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/elephant/lBQrYkMMpOYBrsUc7T56n_3f3e07d132b742eda53bb80c0647c768.jpg","model_url":"https://fal.run/fal-ai/bytedance/seedream/v4/edit","license_type":"commercial","date":"2025-09-09T08:30:47.714Z","group":{"key":"bytedance-image","label":"Seedream 4.0 Edit"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"minimax/h3/image-to-video","metadata":{"display_name":"MiniMax H3 Image to Video","category":"image-to-video","description":"MiniMax H3 is a frontier video model. This endpoint animates a supplied image into 2K video, using it as the opening frame or pairs a first and last frame to control a transition between two images with the aspect ratio following the input.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-08-25T17:41:07.462Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa42dac/wjm-S2eWgG8vU2uJoRwPx.jpg","model_url":"https://fal.run/minimax/h3/image-to-video","license_type":"commercial","date":"2026-07-31T05:54:55.532Z","group":{"key":"hailuo-03-new","label":"Image to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/flux-lora","metadata":{"display_name":"FLUX.1 [dev] with LoRAs","category":"text-to-image","description":"Super fast endpoint for the FLUX.1 [dev] model with LoRA support, enabling rapid and high-quality image generation using pre-trained LoRA adaptations for personalization, specific styles, brand identities, and product-specific outputs.","status":"active","tags":["lora","personalization"],"updated_at":"2026-06-24T10:31:43.297Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9f91af/UMrx6t6mc59z33d20WIQP_iBIZYKKq.png","model_url":"https://fal.run/fal-ai/flux-lora","license_type":"commercial","date":"2024-08-01T00:00:00.000Z","group":{"key":"flux-lora","label":"Text to Image"},"highlighted":false,"kind":"inference","pinned":false,"training_endpoint_ids":["fal-ai/flux-lora-fast-training","fal-ai/turbo-flux-trainer","fal-ai/flux-lora-portrait-trainer"]}},{"endpoint_id":"openrouter/router","metadata":{"display_name":"OpenRouter","category":"llm","description":"Run any LLM with fal. Access Claude (Anthropic), ChatGPT / GPT-5 / GPT-4o (OpenAI), Gemini (Google), Grok (xAI), DeepSeek, Llama (Meta), Qwen (Alibaba), Mistral, and 200+ more models through a single API. Supports reasoning, structured output, and streaming. Powered by OpenRouter.","status":"active","tags":[],"updated_at":"2026-05-06T21:21:33.117Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/rabbit/ZNwvLfWhMW6FsYU4bwn2N_365de1c02b7c4c42bec7659c157b6da4.jpg","model_url":"https://fal.run/openrouter/router","license_type":"commercial","date":"2025-11-12T20:17:58.937Z","group":{"key":"openrouter/router","label":"Any LLM"},"highlighted":false,"kind":"inference","stream_url":"https://fal.run/openrouter/router/stream","pinned":false}},{"endpoint_id":"fal-ai/bytedance/seedream/v4.5/text-to-image","metadata":{"display_name":"Bytedance Seedream V4.5 Text To Image","category":"text-to-image","description":"A new-generation image creation model ByteDance, Seedream 4.5 integrates image generation and image editing capabilities into a single, unified architecture.","status":"active","tags":["stylized","transform"],"updated_at":"2026-04-26T21:58:12.077Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a84c771/1bdm3n1K8bRK-TzYjLF04_57edae699adf457a8a66ae6665a17e3a.jpg","model_url":"https://fal.run/fal-ai/bytedance/seedream/v4.5/text-to-image","license_type":"commercial","date":"2025-12-03T10:46:15.916Z","group":{"key":"Seedream45","label":"Text to Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/esrgan","metadata":{"display_name":"Upscale Images","category":"image-to-image","description":"Upscale images by a given factor.","status":"active","tags":["upscaling","high-res"],"updated_at":"2026-04-21T17:45:19.095Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/falserverless/gallery/esrgan.webp?v=2","thumbnail_animated_url":"https://storage.googleapis.com/falserverless/gallery/esrgan-animated.webp?v=2","model_url":"https://fal.run/fal-ai/esrgan","github_url":"https://github.com/xinntao/Real-ESRGAN/blob/master/LICENSE","license_type":"commercial","date":"2023-10-30T00:00:00.000Z","highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/sam-3/image","metadata":{"display_name":"Segment Anything Model 3","category":"image-to-image","description":"SAM 3 is a unified foundation model for promptable segmentation in images and videos. It can detect, segment, and track objects using text or visual prompts such as points, boxes, and masks. ","status":"active","tags":["segmentation","mask","real-time"],"updated_at":"2026-04-21T17:54:21.610Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/rabbit/kJhu6OfXaBwWYM1PUrWAL_6519f8ea79d649a9bead2e6118f4b997.jpg","model_url":"https://fal.run/fal-ai/sam-3/image","license_type":"commercial","date":"2025-11-20T19:45:11.630Z","group":{"key":"sam3","label":"Image to Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/veo3.1/fast/image-to-video","metadata":{"display_name":"Veo 3.1 Fast","category":"image-to-video","description":"Generate videos from your image prompts using Veo 3.1 fast.","status":"active","tags":[],"updated_at":"2026-04-28T16:29:09.509Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/tiger/CcVVXXOo5stpgsAJV_6UO_74aa2dbdc79447e7ae69b533a7863038.jpg","model_url":"https://fal.run/fal-ai/veo3.1/fast/image-to-video","license_type":"commercial","date":"2025-10-08T17:04:11.604Z","group":{"key":"veo3.1","label":"Image to Video (Fast)"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/bytedance/seedream/v4/text-to-image","metadata":{"display_name":"Bytedance Seedream V4 Text To Image","category":"text-to-image","description":"A new-generation image creation model ByteDance, Seedream 4.0 integrates image generation and image editing capabilities into a single, unified architecture.","status":"active","tags":["stylized","transform"],"updated_at":"2026-06-24T10:33:46.501Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9f91a9/M7ElK8gRPRsRHnAOcaujK_lpIjpXxA.png","model_url":"https://fal.run/fal-ai/bytedance/seedream/v4/text-to-image","license_type":"commercial","date":"2025-09-09T08:27:00.849Z","group":{"key":"bytedance-image","label":"Seedream 4.0 Text to Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/elevenlabs/tts/multilingual-v2","metadata":{"display_name":"ElevenLabs TTS Multilingual v2","category":"text-to-audio","description":"Generate multilingual text-to-speech audio using ElevenLabs TTS Multilingual v2.","status":"active","tags":["audio"],"updated_at":"2026-06-24T10:35:06.936Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9f91b4/QzoZAeoc-h1TLhttOaE7K_jZHvV4ZG.png","model_url":"https://fal.run/fal-ai/elevenlabs/tts/multilingual-v2","license_type":"commercial","date":"2025-02-27T00:00:00.000Z","group":{"key":"elevenlabs-audio","label":"TTS Multilingual v2"},"highlighted":false,"kind":"inference","stream_url":"https://fal.run/fal-ai/elevenlabs/tts/multilingual-v2/stream","pinned":false}},{"endpoint_id":"fal-ai/minimax/speech-02-hd","metadata":{"display_name":"MiniMax Speech-02 HD","category":"text-to-speech","description":"Generate speech from text prompts and different voices using the MiniMax Speech-02 HD model, which leverages advanced AI techniques to create high-quality text-to-speech.","status":"active","tags":["speech"],"updated_at":"2026-06-24T10:36:41.475Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9f91b5/Li_VoZtaOd5__F9GMv1O4_yPTcO4eQ.png","model_url":"https://fal.run/fal-ai/minimax/speech-02-hd","license_type":"commercial","date":"2025-05-06T16:17:49.560Z","group":{"key":"minimax-speech","label":"Text To Speech 2.0 HD"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/wizper","metadata":{"display_name":"Wizper (Whisper v3 -- fal.ai edition)","category":"speech-to-text","description":"[Experimental] Whisper v3 Large -- but optimized by our inference wizards. Same WER, double the performance!","status":"active","tags":["transcription","speech"],"updated_at":"2026-04-21T17:56:32.256Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/falserverless/gallery/wizper.webp","thumbnail_animated_url":"https://storage.googleapis.com/falserverless/gallery/wizper-animated.webp","model_url":"https://fal.run/fal-ai/wizper","github_url":"https://github.com/openai/whisper/blob/main/LICENSE","date":"2024-04-08T00:00:00.000Z","highlighted":false,"pinned":false}},{"endpoint_id":"fal-ai/clarity-upscaler","metadata":{"display_name":"Clarity Upscaler","category":"image-to-image","description":"Clarity upscaler for upscaling images with high very fidelity.","status":"active","tags":["upscaling"],"updated_at":"2026-05-06T21:22:23.372Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/falserverless/gallery/controlnet-tile-upscaler.webp","thumbnail_animated_url":"https://storage.googleapis.com/falserverless/gallery/controlnet-tile-upscaler-animated.webp","model_url":"https://fal.run/fal-ai/clarity-upscaler","license_type":"commercial","date":"2024-02-04T00:00:00.000Z","highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"google/nano-banana-lite/edit","metadata":{"display_name":"Nano Banana Lite Edit","category":"image-to-image","description":"Nano banana lite is the efficiency-focused model in the image generation family. Sub-2 second latency with cost-effective generation and editing, fast multi-turn local edits, and 14 supported aspect ratios.","status":"active","tags":[],"updated_at":"2026-06-30T17:51:16.237Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa065ff/LYSxe7cVmkxjqJto2r6Qv.jpg","model_url":"https://fal.run/google/nano-banana-lite/edit","license_type":"commercial","date":"2026-06-30T17:26:55.185Z","group":{"key":"nano-banana-lite","label":"Image Editing"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/elevenlabs/sound-effects/v2","metadata":{"display_name":"Elevenlabs Sound Effects V2","category":"text-to-audio","description":"Generate sound effects using ElevenLabs advanced sound effects model.","status":"active","tags":["sound"],"updated_at":"2026-04-21T17:45:09.690Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/falserverless/web-examples/elevenlabs/elevenlabs_thumbnail.webp","model_url":"https://fal.run/fal-ai/elevenlabs/sound-effects/v2","license_type":"commercial","date":"2025-09-02T20:11:50.270Z","group":{"key":"elevenlabs-audio","label":"Sound Effects V2"},"highlighted":false,"kind":"inference","stream_url":"https://fal.ai/models/fal-ai/elevenlabs/sound-effects/v2/stream","pinned":false}},{"endpoint_id":"fal-ai/elevenlabs/speech-to-text/scribe-v2","metadata":{"display_name":"ElevenLabs Speech to Text - Scribe V2","category":"speech-to-text","description":"Use Scribe-V2 from ElevenLabs to do blazingly fast speech to text inferences!","status":"active","tags":["speech-to-text"],"updated_at":"2026-04-21T17:45:11.121Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8a5d77/3XtHpcC46Sg0ItPRjB6Uk_82a3a831177745b38f925d35a7b5ed66.jpg","model_url":"https://fal.run/fal-ai/elevenlabs/speech-to-text/scribe-v2","license_type":"commercial","date":"2026-01-14T14:30:10.342Z","group":{"key":"e11-speech-to-text","label":"Scribe V2"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/elevenlabs/music","metadata":{"display_name":"Elevenlabs Music","category":"text-to-audio","description":"Generate high quality, realistic music with fine controls using Elevenlabs Music!","status":"active","tags":["music","text-to-music"],"updated_at":"2026-08-18T21:02:01.110Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a875694/SZffdb8layV90JxfN5fkP_d2048a658d9e4dc9973598f3542833a0.jpg","model_url":"https://fal.run/fal-ai/elevenlabs/music","license_type":"commercial","date":"2025-12-22T15:22:56.999Z","highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/birefnet","metadata":{"display_name":"Birefnet Background Removal","category":"image-to-image","description":"bilateral reference framework (BiRefNet) for high-resolution dichotomous image segmentation (DIS)","status":"active","tags":["background removal","segmentation","high-res","utility"],"updated_at":"2026-05-13T20:07:10.362Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/falserverless/gallery/birefnet.webp","thumbnail_animated_url":"https://storage.googleapis.com/falserverless/gallery/birefnet-animated.webp","model_url":"https://fal.run/fal-ai/birefnet","license_type":"commercial","date":"2024-02-27T00:00:00.000Z","highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"minimax/h3-max/multi-angle/image-to-video","metadata":{"display_name":"H3 Max Multi Angle","category":"image-to-video","description":"H3 Max Multi Angle turns a single image into a video with precise, keyframe-based control over the camera's orbit, elevation, and distance in 3D space","status":"active","tags":["stylized","transform","editing"],"updated_at":"2026-09-10T09:39:00.078Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa9a24f/8qZ-4SRSAwJBkzC6bKwBL.jpg","model_url":"https://fal.run/minimax/h3-max/multi-angle/image-to-video","license_type":"commercial","date":"2026-09-08T20:27:24.016Z","group":{"key":"hailuo-03-new-turbo","label":"Multi Angle"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/veo3.1/image-to-video","metadata":{"display_name":"Veo 3.1","category":"image-to-video","description":"Veo 3.1 is the latest state-of-the art video generation model from Google DeepMind","status":"active","tags":[],"updated_at":"2026-04-28T16:29:09.509Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/zebra/G680VZS5VpMMQO1pSt2uj_dfbae33f738344aa98a62cf2022c427c.jpg","model_url":"https://fal.run/fal-ai/veo3.1/image-to-video","license_type":"commercial","date":"2025-10-08T17:02:47.996Z","group":{"key":"veo3.1","label":"Image to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/gemini-3-pro-image-preview/edit","metadata":{"display_name":"Gemini 3 Pro Image Preview","category":"image-to-image","description":"Gemini 3 Pro Image (a.k.a Nano Banana Pro) is Google's state-of-the-art high-fidelity image generation and editing model","status":"active","tags":["realism","typography"],"updated_at":"2026-04-28T16:29:09.509Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/penguin/Vp2KdBwHgd4Qp0ixnsOue_eb81afc63ac24064bc9d3e9ed48f9b74.jpg","model_url":"https://fal.run/fal-ai/gemini-3-pro-image-preview/edit","license_type":"commercial","date":"2025-11-20T14:29:56.085Z","group":{"key":"Gemini-3-Pro","label":"Image Editing"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/flux-2","metadata":{"display_name":"FLUX 2","category":"text-to-image","description":"Text-to-image generation with FLUX.2 [dev] from Black Forest Labs. Enhanced realism, crisper text generation, and native editing capabilities.","status":"active","tags":[],"updated_at":"2026-05-27T00:51:44.726Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/penguin/zSBCJtPpeIQwR5AC_IamX_b1e1137961754e4d851907c21f8c20cd.jpg","model_url":"https://fal.run/fal-ai/flux-2","license_type":"commercial","date":"2025-11-23T00:15:07.672Z","group":{"key":"Flux2","label":"Text to Image"},"highlighted":false,"kind":"inference","stream_url":"https://fal.ai/models/fal-ai/flux-2/stream","pinned":false}},{"endpoint_id":"fal-ai/gemini-3.1-flash-tts","metadata":{"display_name":"Gemini 3.1 Flash Tts","category":"text-to-speech","description":"Newest audio model from Google introduces granular audio tags that give you precise control to direct AI speech for expressive audio generation.","status":"active","tags":["lipsync","avatar",""],"updated_at":"2026-08-26T16:56:42.491Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a959ab9/uM2hZiKHOALvYZA2dBlB3_fa351c0ec002415e968d93c006094bae.jpg","model_url":"https://fal.run/fal-ai/gemini-3.1-flash-tts","license_type":"commercial","date":"2026-04-16T12:29:10.178Z","highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"xai/grok-imagine-video/image-to-video","metadata":{"display_name":"Grok Imagine Video","category":"image-to-video","description":"Generate videos from images with audio using xAI's Grok Imagine Video model. ","status":"active","tags":["grok","xai","image-to-video","i2v"],"updated_at":"2026-04-26T22:32:05.599Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8a0dd0/3wXg362MQ0pczC2ZQFBfW_c153dd469fd14b75bbd9fa6d27f1b63e.jpg","model_url":"https://fal.run/xai/grok-imagine-video/image-to-video","license_type":"commercial","date":"2026-01-29T00:27:07.613Z","group":{"key":"grok-imagine-video","label":"Image to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/bytedance/seedance/v1.5/pro/image-to-video","metadata":{"display_name":"Bytedance Seedance V1.5 Pro Image To Video","category":"image-to-video","description":"Generate videos with audio with Seedance 1.5 (supports start & end frame) ","status":"active","tags":["bytedance","seedance","audio"],"updated_at":"2026-04-21T17:44:33.564Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a876c74/q6J8OsmO08A3zCFGCtsUj_cb48562eeef345b29269689dd4f95671.jpg","model_url":"https://fal.run/fal-ai/bytedance/seedance/v1.5/pro/image-to-video","license_type":"commercial","date":"2025-12-23T06:56:11.614Z","group":{"key":"seedance-v15","label":"Image to Video Pro v1.5"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/gemini-25-flash-image/edit","metadata":{"display_name":"Gemini 2.5 Flash Image","category":"image-to-image","description":"Google's famous original image generation and editing model, a.k.a Nano Banana","status":"active","tags":["image-editing"],"updated_at":"2026-06-24T10:34:10.220Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9f91aa/DgAD0PTXm4IPy4MhNlykk_WkMVBWXT.png","model_url":"https://fal.run/fal-ai/gemini-25-flash-image/edit","license_type":"commercial","date":"2025-08-26T01:22:27.733Z","group":{"key":"gemini-25-flash","label":"Image Editing"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"xai/grok-imagine-image","metadata":{"display_name":"Grok Imagine Image","category":"text-to-image","description":"Generate highly aesthetic images with xAI's Grok Imagine Image generation model.","status":"active","tags":["xai","grok","text-to-image"],"updated_at":"2026-04-26T22:32:05.599Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8c4b97/vZlFRoT1SBs5XMoVqN_P5_f4b2e3f42dcc4f06a18953fda2b5c942.jpg","model_url":"https://fal.run/xai/grok-imagine-image","license_type":"commercial","date":"2026-01-29T00:28:58.441Z","group":{"key":"grok-imagine-image","label":"Text to Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"xai/grok-imagine-video/v1.5/image-to-video","metadata":{"display_name":"Grok Imagine Video 1.5","category":"image-to-video","description":"Generate videos from images with audio using xAI's Grok Imagine 1.5 Video model.\n","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-08-01T01:47:30.279Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9c2fbd/9sTsrztjz1KsxHWj1ONNM_b6a22e5d6ce2424aadbf4c3a7cf5f73a.jpg","model_url":"https://fal.run/xai/grok-imagine-video/v1.5/image-to-video","license_type":"commercial","date":"2026-05-31T09:39:00.693Z","group":{"key":"imagine15","label":"Image to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"meta/muse-image/edit","metadata":{"display_name":"Meta Muse Image Edit","category":"image-to-image","description":"Meta's Muse Image model does precise edits that change only what you ask, stay coherent across turns, and compose from multiple reference images.","status":"active","tags":["realism","typography","stylized","editing"],"updated_at":"2026-08-26T23:18:56.367Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa743e9/p2RjYTFPCviexLZ_6oYmv.jpg","model_url":"https://fal.run/meta/muse-image/edit","license_type":"commercial","date":"2026-08-21T19:14:53.788Z","group":{"key":"meta-muse-image","label":"Image Editing"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/elevenlabs/tts/turbo-v2.5","metadata":{"display_name":"ElevenLabs TTS Turbo v2.5","category":"text-to-speech","description":"Generate high-speed text-to-speech audio using ElevenLabs TTS Turbo v2.5.","status":"active","tags":["audio"],"updated_at":"2026-04-21T17:45:15.737Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/falserverless/web-examples/elevenlabs/elevenlabs_thumbnail.webp","model_url":"https://fal.run/fal-ai/elevenlabs/tts/turbo-v2.5","license_type":"commercial","date":"2025-02-27T00:00:00.000Z","group":{"key":"elevenlabs-audio","label":"TTS Turbo v2.5"},"highlighted":false,"kind":"inference","stream_url":"https://fal.run/fal-ai/elevenlabs/tts/turbo-v2.5/stream","pinned":false}},{"endpoint_id":"xai/grok-imagine-image/v2.0/edit","metadata":{"display_name":"Grok Imagine Image 2.0","category":"image-to-image","description":"Edit images with xAi's Grok Imagine 2.0 model.","status":"active","tags":["xai","grok","image-editing"],"updated_at":"2026-08-20T23:47:27.128Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa53f9f/NPxHgnCK_ldUc0dOfNe1q.jpg","model_url":"https://fal.run/xai/grok-imagine-image/v2.0/edit","license_type":"commercial","date":"2026-08-06T12:22:53.411Z","group":{"key":"imagine20","label":"Edit Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/flux-2/klein/9b/edit","metadata":{"display_name":"FLUX.2 [klein] 9B","category":"image-to-image","description":"Image-to-image editing with FLUX.2 [klein] 9B from Black Forest Labs. Precise modifications using natural language descriptions and hex color control.","status":"active","tags":[],"updated_at":"2026-03-17T15:26:34.088Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8a7f50/X8ffS5h55gcigsNZoNC7O_52e6b383ac214d2abe0a2e023f03de88.jpg","model_url":"https://fal.run/fal-ai/flux-2/klein/9b/edit","license_type":"commercial","date":"2026-01-15T12:25:09.939Z","group":{"key":"klein","label":"9B Image Edit"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"minimax/music-3","metadata":{"display_name":"MiniMax Music 3","category":"text-to-audio","description":"MiniMax Music 3 is a high-performance music generation model for creating complete songs up to five minutes long","status":"active","tags":["sfx","audio","effects",""],"updated_at":"2026-08-18T17:00:49.092Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa6363a/E6MV5Yy0mhJ2pOzNHcHAU.jpg","model_url":"https://fal.run/minimax/music-3","license_type":"commercial","date":"2026-08-13T19:47:14.143Z","highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/gpt-image-1.5/edit","metadata":{"display_name":"GPT-Image 1.5","category":"image-to-image","description":"GPT Image 1.5 generates high-fidelity images with strong prompt adherence, preserving composition, lighting, and fine-grained detail.","status":"active","tags":["openai","gpt-image"],"updated_at":"2026-04-21T17:47:54.587Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a875814/3KvlvWItvogHIOuPRWIVl_001c9e77742a4ff2a829a8ece127c0d1.jpg","model_url":"https://fal.run/fal-ai/gpt-image-1.5/edit","license_type":"commercial","date":"2025-12-16T18:38:20.664Z","group":{"key":"gpt-image-1.5","label":"Edit Image"},"highlighted":false,"kind":"inference","stream_url":"https://fal.run/fal-ai/gpt-image-1.5/edit/stream","pinned":false}},{"endpoint_id":"alibaba/wan-3.0-prime/reference-to-video","metadata":{"display_name":"Wan 3.0 Prime","category":"video-to-video","description":"Wan 3.0 Prime Reference-to-Video combines reference images, videos, and audio into a unified video with fast generation and strong multimodal coherence. It follows character identity, visual style, movement, and sound cues across references to create controlled, consistent, and production-ready results.","status":"active","tags":["reference","video"],"updated_at":"2026-08-24T06:03:21.673Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa79464/AfVcXUCY_wyxlQVsAGpx2.jpg","model_url":"https://fal.run/alibaba/wan-3.0-prime/reference-to-video","license_type":"commercial","date":"2026-08-24T04:43:49.156Z","group":{"key":"Wan30prime","label":"Reference to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"google/gemini-omni-flash/v1.1/image-to-video","metadata":{"display_name":"Gemini Omni Flash 1.1 Image to Video","category":"image-to-video","description":"Gemini Omni Flash 1.1 is Google's multimodal video model. This endpoint animates a still image into video with synchronized audio, extending a single frame into coherent motion that reflects the logic of the real world.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-09-01T21:51:13.659Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa7d026/PJ7ZGzXOLHWc0V7C2aN9r.jpg","model_url":"https://fal.run/google/gemini-omni-flash/v1.1/image-to-video","license_type":"commercial","date":"2026-08-25T23:13:54.630Z","group":{"key":"gemini-omni-11","label":"Image to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/minimax/speech-2.8-hd","metadata":{"display_name":"MiniMax Speech 2.8 [HD]","category":"text-to-speech","description":"Generate speech from text prompts and different voices using the MiniMax Speech-2.8 HD model, which leverages advanced AI techniques to create high-quality text-to-speech.","status":"active","tags":[],"updated_at":"2026-05-07T21:20:34.572Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8d0e4a/5FhhsQ0BicVC_DZ_BDLGL_895a8e6af34848f8844c20244c3e4672.jpg","model_url":"https://fal.run/fal-ai/minimax/speech-2.8-hd","license_type":"commercial","date":"2026-02-04T00:13:29.621Z","group":{"key":"minimax-speech","label":"Text To Speech 2.8 HD"},"highlighted":false,"kind":"inference","stream_url":"https://fal.run/fal-ai/minimax/speech-2.8-hd/stream","pinned":false}},{"endpoint_id":"fal-ai/ideogram/v3","metadata":{"display_name":"Ideogram Text to Image","category":"text-to-image","description":"Generate high-quality images, posters, and logos with Ideogram V3. Features exceptional typography handling and realistic outputs optimized for commercial and creative use.","status":"active","tags":["realism","typography"],"updated_at":"2026-06-24T10:32:24.316Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9f91a8/JsTVqtZydplqvV_XGPvTV_5FOy6fcj.png","model_url":"https://fal.run/fal-ai/ideogram/v3","license_type":"commercial","date":"2025-05-01T16:04:02.805Z","group":{"key":"ideogram-v3","label":"Text to Image"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/veo3.1/lite/image-to-video","metadata":{"display_name":"Veo3.1 Lite Image to Video","category":"image-to-video","description":"Veo 3.1 Lite balances practical utility with professional capabilities, supporting Text-to-Video and Image-to-Video","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-04-28T16:29:09.509Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a946101/jRTUp9enYBh3ypsb0Ux0a_fe5ca5e28e704976bfff127c5d23f6a9.jpg","model_url":"https://fal.run/fal-ai/veo3.1/lite/image-to-video","license_type":"commercial","date":"2026-03-31T18:35:02.766Z","group":{"key":"veo3.1","label":"Image to Video (Lite)"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/kling-video/v3/pro/text-to-video","metadata":{"display_name":"Kling Video v3 Text to Video [Pro]","category":"text-to-video","description":"Kling 3.0 Pro: Top-tier text-to-video with cinematic visuals, fluid motion, and native audio generation, with multi-shot support.","status":"active","tags":["text-to-video"],"updated_at":"2026-04-26T22:25:17.147Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8cfd13/t6TSkWzl6cFAzvO1PCdDu_f38263f637d245929f03881454951540.jpg","model_url":"https://fal.run/fal-ai/kling-video/v3/pro/text-to-video","license_type":"commercial","date":"2026-02-04T15:48:44.935Z","group":{"key":"kling-v3","label":"Text to Video (pro)"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"krea/v2/large/text-to-image","metadata":{"display_name":"Krea 2 Large","category":"text-to-image","description":"Generate high-fidelity images from text with Krea 2 Large, supporting aspect ratio, creativity, seed controls, and optional style references.","status":"active","tags":["text-to-image","image-generation","style-reference","krea","krea-2"],"updated_at":"2026-06-30T18:57:25.450Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9c2fb3/ATU9JDQwjBy0xRtTwPbft_7338811c31e94f11b04ef25761fe530f.jpg","model_url":"https://fal.run/krea/v2/large/text-to-image","license_type":"commercial","date":"2026-05-27T08:04:43.864Z","group":{"key":"krea2","label":"Krea 2 Large"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/kling-video/v2.1/standard/image-to-video","metadata":{"display_name":"Kling 2.1 (standard)","category":"image-to-video","description":"Kling 2.1 Standard is a cost-efficient endpoint for the Kling 2.1 model, delivering high-quality image-to-video generation \n\n","status":"active","tags":[],"updated_at":"2026-04-26T22:25:17.147Z","is_favorited":null,"thumbnail_url":"https://v3.fal.media/files/elephant/5Yt8D9tl-IaGQ-6czSXL1_HHQ_VCby6xP_DFLkQQLpV_3c8622214c4c4ac29b4b64e157746507.jpg","model_url":"https://fal.run/fal-ai/kling-video/v2.1/standard/image-to-video","license_type":"commercial","date":"2025-05-28T20:59:07.301Z","group":{"key":"kling-video-v21","label":"2.1 Standard (Image to Video)"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/hunyuan-3d/v3.1/pro/image-to-3d","metadata":{"display_name":"Hunyuan 3D Pro Image to 3D","category":"image-to-3d","description":"Generate 3D models from images with Hunyuan 3D Pro","status":"active","tags":["3d","hunyuan","image-to-3d"],"updated_at":"2026-04-28T16:47:25.903Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8c1eed/a9u-FinZ2o0AGqcGFlRoD_5c16e7c0e1ae412cacc53893cae95698.jpg","model_url":"https://fal.run/fal-ai/hunyuan-3d/v3.1/pro/image-to-3d","license_type":"commercial","date":"2026-01-27T22:01:04.639Z","group":{"key":"hunyuan-3d","label":"Hunyuan 3D Pro Image to 3D"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/kling-video/o3/pro/image-to-video","metadata":{"display_name":"Kling O3 Image to Video [Pro]","category":"image-to-video","description":"Generate a video by taking a start frame and an end frame, animating the transition between them while following text-driven style and scene guidance.","status":"active","tags":["image-to-video"],"updated_at":"2026-04-26T22:25:17.147Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8cfcae/X9YwYvvnjSHOx_K4G8s69_395daf17841f4097a7cff719154bfad4.jpg","model_url":"https://fal.run/fal-ai/kling-video/o3/pro/image-to-video","license_type":"commercial","date":"2026-02-04T15:48:44.935Z","group":{"key":"kling-o3","label":"Image To Video (pro)"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"bytedance/seedance-2.0/text-to-video","metadata":{"display_name":"Seedance 2.0 Text to Video API","category":"text-to-video","description":"ByteDance's most advanced text-to-video model. Cinematic output with native audio, multi-shot editing, real-world physics, and director-level camera control.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-07-10T18:12:05.187Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9c2f13/XcRHMX9gZIMSYL7ImArbn_ed7636768b1f41d286c66ed5ebc0521d.jpg","model_url":"https://fal.run/bytedance/seedance-2.0/text-to-video","license_type":"commercial","date":"2026-04-01T18:49:18.123Z","group":{"key":"seedance-2.0-fal","label":"Text to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"bytedance/seedance-2.0/fast/image-to-video","metadata":{"display_name":"Seedance 2.0 Fast Image to Video","category":"image-to-video","description":"ByteDance's most advanced image-to-video model, fast tier. Lower latency and cost with synchronized audio, start and end frame control, and motion prompts.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-04-22T18:07:06.536Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9460fd/T3K2mVx51M-pOewqVAb1g_408d1bcc1efc4cfa902293ac5b1f378d.jpg","model_url":"https://fal.run/bytedance/seedance-2.0/fast/image-to-video","license_type":"commercial","date":"2026-04-01T18:43:34.817Z","group":{"key":"seedance-2.0-fal","label":"Image to Video Fast"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"bytedance/seedance-2.0/fast/reference-to-video","metadata":{"display_name":"Seedance 2.0 Fast Reference to Video","category":"image-to-video","description":"ByteDance's most advanced reference-to-video model, fast tier. Lower latency and cost with up to 9 images, 3 videos, and 3 audio clips as inputs.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-07-01T20:55:35.293Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9c2f0f/CksSmhus-kf2wceFqGv6u_28b605ee7aca4793871852ab3ecd70b6.jpg","model_url":"https://fal.run/bytedance/seedance-2.0/fast/reference-to-video","license_type":"commercial","date":"2026-04-01T18:46:16.471Z","group":{"key":"seedance-2.0-fal","label":"Reference to Video Fast"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/imageutils/rembg","metadata":{"display_name":"Remove Background","category":"image-to-image","description":"Remove the background from an image.","status":"active","tags":["background removal","utility","editing"],"updated_at":"2026-06-24T10:34:22.956Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a9f91aa/pdmTi9vgamfQXR6pcroyX_YYkyUfre.png","thumbnail_animated_url":"https://storage.googleapis.com/falserverless/gallery/remove-background-animated.webp","model_url":"https://fal.run/fal-ai/imageutils/rembg","github_url":"https://github.com/danielgatis/rembg/blob/main/LICENSE.txt","license_type":"commercial","date":"2023-10-05T00:00:00.000Z","highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"alibaba/wan-3.0/reference-to-video","metadata":{"display_name":"Wan 3.0","category":"image-to-video","description":"Wan 3.0 is the latest generation AI video model, delivering enhanced motion smoothness, superior scene fidelity, and greater visual coherence.","status":"active","tags":["stylized","transform","lipsync"],"updated_at":"2026-08-24T03:15:20.439Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0aa4e980/FY0Yw0B-_KVknj6qtv5sp.jpg","model_url":"https://fal.run/alibaba/wan-3.0/reference-to-video","license_type":"commercial","date":"2026-08-03T23:56:31.060Z","group":{"key":"Wan30","label":"Reference to Video"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/kling-video/o3/standard/image-to-video","metadata":{"display_name":"Kling O3 Image to Video [Pro]","category":"image-to-video","description":"Generate a video by taking a start frame and an end frame, animating the transition between them while following text-driven style and scene guidance.","status":"active","tags":["image-to-video"],"updated_at":"2026-04-26T22:25:17.147Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8d2007/gV_LMXNrguqRaDB9sLqir_b5d36b36de5a40bdb5cb2cd3f8af29d7.jpg","model_url":"https://fal.run/fal-ai/kling-video/o3/standard/image-to-video","license_type":"commercial","date":"2026-02-04T15:48:44.935Z","group":{"key":"kling-o3","label":"Image to Video (standard)"},"highlighted":false,"kind":"inference","pinned":false}},{"endpoint_id":"fal-ai/flux-pro/v1/fill","metadata":{"display_name":"FLUX.1 [pro] Fill","category":"image-to-image","description":"FLUX.1 [pro] Fill is a high-performance endpoint for the FLUX.1 [pro] model that enables rapid transformation of existing images, delivering high-quality style transfers and image modifications with the core FLUX capabilities.","status":"active","tags":["editing"],"updated_at":"2026-04-21T17:47:29.481Z","is_favorited":null,"thumbnail_url":"https://storage.googleapis.com/falserverless/gallery/fluxpro.jpg","model_url":"https://fal.run/fal-ai/flux-pro/v1/fill","license_type":"commercial","date":"2024-11-21T00:00:00.000Z","group":{"key":"flux-pro","label":"FLUX.1 [pro] Fill"},"highlighted":false,"pinned":false}},{"endpoint_id":"fal-ai/flux-2/edit","metadata":{"display_name":"FLUX 2 Edit","category":"image-to-image","description":"Image-to-image editing with FLUX.2 [dev] from Black Forest Labs. Precise modifications using natural language descriptions and hex color control.","status":"active","tags":[],"updated_at":"2026-04-21T17:46:46.279Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/panda/zYjw3YqOcfDQymX7cvMBl_3d76809c48f74eb9abe3e17e1bdd5d2d.jpg","model_url":"https://fal.run/fal-ai/flux-2/edit","license_type":"commercial","date":"2025-11-23T00:15:40.781Z","group":{"key":"Flux2","label":"Image Editing"},"highlighted":false,"kind":"inference","stream_url":"https://fal.ai/models/fal-ai/flux-2/edit/stream","pinned":false,"training_endpoint_ids":["flux-2-trainer/edit"]}},{"endpoint_id":"fal-ai/kling-video/o3/pro/video-to-video/edit","metadata":{"display_name":"Kling O3 Edit Video [Pro]","category":"video-to-video","description":"Edit videos using Kling O3 from Kling Team!","status":"active","tags":["video-to-video"],"updated_at":"2026-04-26T22:25:17.147Z","is_favorited":null,"thumbnail_url":"https://v3b.fal.media/files/b/0a8cfcd0/jgn9feXep4nJXWf0tg1cf_6867c6921b6a4015a1906c8e02a7ef9d.jpg","model_url":"https://fal.run/fal-ai/kling-video/o3/pro/video-to-video/edit","license_type":"commercial","date":"2026-02-04T15:48:44.935Z","group":{"key":"kling-o3","label":"Edit Video (pro)"},"highlighted":false,"kind":"inference","pinned":false}}],"next_cursor":"Mg","has_more":true}
