Futuros
Acesse centenas de contratos perpétuos
CFD
Ouro
Plataforma única para ativos tradicionais globais
Opções
Hot
Negocie opções vanilla no estilo europeu
Conta unificada
Maximize sua eficiência de capital
Negociação demo
Introdução à negociação de futuros
Prepare-se para sua negociação de futuros
Eventos de futuros
Participe de eventos e ganhe recompensas
Negociação demo
Use fundos virtuais para experimentar negociações sem riscos
CFD
Derivativos de CFD sobre ações
Ações dos EUA
Acesse ações e ETFs reais dos EUA
Ações de Hong Kong
Negocie ações de qualidade listadas em Hong Kong
Ações da Coreia
SK Hynix
Negocie ações da Coreia reais e invista em ativos populares
Futuros de ações
Alta alavancagem, negociação 24/7
Ações tokenizadas
Respaldado por ativos de ações reais
IPO Access
Desbloqueie o acesso completo a IPO de ações globais
GUSD
3.8%
Cunhe GUSD para rendimentos de RWA do Tesouro
Atividades de ações
Negocie ações populares e desbloqueie airdrops generosos
Lançamento
CandyDrop
Colete candies para ganhar airdrops
Launchpool
Staking rápido, ganhe novos tokens em potencial
HODLer Airdrop
Possua GT em hold e ganhe airdrops massivos de graça
Pre-IPOs
Desbloqueie o acesso completo a IPO de ações globais
Pontos Alpha
Negocie on-chain e receba airdrops
Pontos de futuros
Ganhe pontos de futuros e colete recompensas em airdrop
Investimento
Simple Earn
Ganhe juros com tokens ociosos
Autoinvestimento
Invista automaticamente regularmente
Investimento duplo
Lucre com a volatilidade do mercado
Soft Staking
Ganhe recompensas com stakings flexíveis
Empréstimo de criptomoedas
0 Fees
Penhore uma criptomoeda para pegar outra emprestado
Centro de empréstimos
Centro de empréstimos integrado
Centro de riqueza VIP
Planos premium de crescimento de patrimônio
Gate Wealth
Assuma o controle do seu futuro financeiro
Fundo Quantitativo
Estratégias quant de alto nível
Apostar
Faça staking de criptomoedas para ganhar em produtos PoS
Alavancagem Inteligente
Alavancagem sem liquidação
GUSD
3.8%
Deposite e resgate a qualquer momento, sem taxas
Promoções
Centro de atividade
Participe de atividades e ganhe recompensas
Indicação
200 USDT
Convide amigos para recompensas de ind.
Programa de afiliados
Ganhe recomp. de comissão exclusivas
Gate Booster
Aumente a influência e ganhe airdrops
Anúncio
Atualizações na plataforma em tempo real
Blog da Gate
Artigos do setor de criptomoedas
Serviços VIP
Grandes Descontos nas Taxas
Gerenciamento de ativos
Solução completa de gerenciamento de ativos
Institucional
Soluções de ativos digitais para empresas
Desenvolvedores (API)
Conecta-se ao ecossistema de aplicativos da Gate
Transferência Bancária OTC
Deposite e retire moedas fiat
Programa de corretoras
Mecanismos de grandes descontos via API
AI
Gate AI
Seu parceiro de IA conversacional para todas as horas
Gate AI Bot
Use o Gate AI diretamente no seu aplicativo social
GateClaw
Gate Blue Lobster, pronto para usar
Gate for AI Agent
Infraestrutura de IA, Gate MCP, Skills e CLI
Gate Skills Hub
10K+ habilidades
Do escritório à negociação: um hub completo de habilidades para turbinar o uso da IA
豆包 Seed Audio 1.0 é lançado: gera voz humana + trilha musical + efeitos sonoros ambientais em uma etapa
A equipe do DOU Bao, subsidiária da ByteDance, anunciou oficialmente nesta semana o modelo de geração de áudio Seed Audio 1.0, também chamado de modelo de geração de áudio do DOU Bao 1.0, e lançou simultaneamente no centro de experiência da Volcano Ark (火山方舟) a opção de testes para criadores. A plataforma também abriu convites para testes da API no lado corporativo.
No passado, ao criar uma faixa de narração, a voz humana, a trilha musical e os efeitos sonoros geralmente eram gravados separadamente, com cronogramas separados, para então, no fim, serem montados manualmente em um software de edição. Desta vez, o DOU Bao quer fazer algo diferente: gerar todo o cenário sonoro em uma única inferência, sem que o usuário precise atuar como “cabo de ligação” no meio do processo.
Usuários individuais podem começar diretamente no centro de experiência da Volcano Ark; desenvolvedores internacionais acessam via BytePlus. O modelo também já foi integrado ao próprio app do DOU Bao.
Do roteiro ao cenário
O Seed Audio 1.0 não é um TTS tradicional. TTS é texto para voz: em termos simples, é “ler” um trecho de texto. Já o Seed Audio 1.0 trata voz humana, música de fundo, efeitos sonoros e sons ambiente como elementos do mesmo cenário de áudio, mapeando tudo para uma representação acústica unificada.
Em outras palavras, o modelo não separa “quem está falando” e “qual é o som de fundo”; ele trata o cenário inteiro como um só objeto para gerar junto.
Ele suporta referência multimodal de zero-shot. Em termos simples, sem precisar fazer novo treinamento, você fornece um trecho de texto ou um pedaço de áudio como exemplo, e o modelo consegue imitar o timbre e o estilo daquele som. Com um único prompt, dá para organizar múltiplos diálogos de personagens, música de fundo e efeitos de dublagem — efeitos sonoros no jargão da área de locução. Mesmo que o áudio gerado seja estendido para quase 2 minutos, os timbres de vários personagens não “desafinariam” no meio do caminho.
A precisão no controle da linha do tempo chega a 100 milissegundos: quando os personagens começam a falar e quando os efeitos entram, tudo pode ser ajustado com bastante exatidão. O suporte a idiomas passa de 20 línguas: chinês, inglês e japonês estão entre elas. O timbre e o estilo também podem ser ajustados separadamente, sem precisar trocar completamente o som só porque você vai mudar a forma de falar.
Essas capacidades correspondem à criação de áudio em nível de cinema e TV, cobrindo etapas como narração, trilha musical, dublagem sonora (擬音) e mixagem, e também se estendem a audiolivros, radionovelas, podcasts, vídeos curtos, jogos e mídias interativas. Em outras palavras, tarefas que antes exigiam uma equipe inteira de pós-produção são reunidas em um único modelo.
Por que “desmontar” o som para encará-lo de novo
A lógica por trás da geração de voz tradicional costuma dividir a tarefa em várias frentes: síntese de fala em uma linha, trilha musical em outra, efeitos sonoros em outra. Cada uma é treinada e exportada separadamente, e o usuário depois junta tudo manualmente na mesma linha do tempo para alinhar.
A lógica do Seed Audio 1.0 é o inverso: primeiro coloca todos os elementos sonoros no mesmo espaço de representação e então gera tudo de uma vez. A vantagem disso é que o timbre entre personagens e a música e os efeitos dentro do cenário já nascem sincronizados, sem necessidade de calibração posterior.
Três passos da ElevenLabs, um passo do DOU Bao
Comparando com o Studio da ElevenLabs, fica ainda mais claro. O método da ElevenLabs separa três APIs independentes: voz, música e efeitos sonoros. Cada uma gera por conta própria, e o usuário precisa montar e alinhar na linha do tempo; o DOU Bao pretende substituir esses passos todos por uma única inferência.
Em termos de preço, o ElevenLabs Pro custa US$ 99 por mês. Já o DOU Bao, usando a cobrança por tokens do motor Volcano (火山), calcula o custo pelo uso — e, em cenários com chinês, o custo tende a ser bem menor.
Narração, trilha musical e efeitos eram, no passado, três ocupações, três conjuntos de softwares e três exportações. O Seed Audio 1.0 quer demonstrar que esses processos podem ser compactados em uma única inferência.
Quanto a substituir de verdade as divisões profissionais em cenários como dublagem para cinema e TV, audiolivros e podcasts, é algo que só os criadores saberão dizer depois que usarem.