Alibaba lança Qwen3.5-Omni com recursos de áudio superiores ao Gemini

A gigante tecnológica chinesa Alibaba Cloud acaba de expandir o seu leque de ofertas com a introdução da série Qwen3.5-Omni, um novo modelo de linguagem de grande escala omnimodal. De acordo com os detalhes partilhados no blogue oficial da Qwen, esta nova aposta destaca-se por suportar nativamente a compreensão integrada de texto, imagem, áudio e … Ler mais

Google Docs melhora a acessibilidade com resumos em áudio criados pela IA Gemini

A Google quer transformar a forma como os utilizadores interagem com texto escrito. O que começou por ser um teste discreto, no ano passado, com o leitor de documentos que usava o Gemini, está agora a ganhar uma dimensão muito mais robusta. A tecnológica de Mountain View está a expandir as capacidades do Google Docs, … Ler mais

Google Docs apresenta novos resumos em áudio do Gemini para leitura

O ecossistema de produtividade da Google acaba de receber um reforço que promete mudar a forma como geres o teu fluxo de trabalho diário. Se costumas lidar com documentos extensos e sentes que te falta tempo para ler tudo detalhadamente, a mais recente atualização do Google Docs foi pensada especificamente para o teu perfil. Através … Ler mais

Google Docs muda regras: Gemini agora lê e resume seus documentos em áudio

A Google oficializou uma novidade que promete mudar a forma como interagimos com textos longos no ambiente de trabalho e estudo. O famoso editor de texto conta agora com resumos em áudio gerados pela inteligência artificial Gemini. Esta funcionalidade permite que os utilizadores oiçam uma síntese falada de documentos complexos diretamente na versão web da … Ler mais

OpenAI aposta em hardware de áudio para acompanhar a tendência do mercado

Parece que, com a virada do ano, a OpenAI decidiu mudar de rota e encontrar novas fontes de receita para o negócio que, até agora, tem apenas queimado caixa. Conhecida por softwares e grandes modelos de linguagem (LLMs), a dona do ChatGPT agora quer apostar em hardwares. Segundo informações obtidas pelo The Information, a OpenAI … Ler mais

OpenAI investe em tecnologia de hardware de áudio e amplia sua atuação além do ChatGPT

A OpenAI aposta em hardware de áudio ao reorganizar suas equipes internas para viabilizar um novo dispositivo pessoal sem tela, segundo informações publicadas. A iniciativa mira uma interação por voz contínua e natural, distante do modelo tradicional de aplicativos e telas. Nos últimos dois meses, a empresa unificou áreas de engenharia, produto e pesquisa para … Ler mais

Caneta Inteligente e Dispositivos de Áudio: Conheça as Melhores Opções do Mercado

A OpenAI, a empresa criadora do ChatGPT, está a preparar-se para expandir o seu império do software para o mundo dos objetos físicos. Segundo os media especializados internacionais, que citam fontes anónimas da cadeia de abastecimento, a empresa liderada por Sam Altman está a desenvolver uma linha de três dispositivos de hardware sob o nome … Ler mais

100 Anos de Rádio no Brasil: O Novo Ciclo do Som em 2025 – Rádio, Inteligência Artificial e Economia do Áudio Digital.

Por Álvaro Bufarah (*) O som voltou a ocupar o centro das atenções – mas com novas vozes, interfaces e estratégias. Este é o último texto do ano e acredito que devemos refletir sobre o que apresentamos neste espaço ao longo de 2025. O rádio, o podcast, o streaming e as plataformas de voz vivem … Ler mais

ChatGPT agora permite envio de áudio no chat, aumentando rivalidade com Gemini

A experiência com o ChatGPT ficou mais próxima de uma conversa natural: agora, é possível enviar áudios direto no app ou na versão web, sem precisar pular para outra tela. Basta tocar no ícone em forma de onda ao lado do campo de texto e falar, enquanto a transcrição acontece em tempo real. O recurso … Ler mais

Passatempo Imacustica: Ofertas imperdíveis para áudio e cinema em casa da MHD

O Natal está a chegar e a Imacustica juntou-se à Magazine.HD para oferecer um belo kit de produtos perfeitos para qualquer apaixonado por música. A Imacustica é uma das principais lojas e distribuidora em Portugal no que toca ao áudio de alta fidelidade, cinema em casa, sistemas e soluções acústicas para todas as casas e … Ler mais

Como transformar PDFs em arquivos de áudio no Google Drive

Créditos: Unsplash Hoje é dia de aprender: saiba agora mesmo como transformar PDFs em arquivos de áudio no Google Drive! O Google Drive agora integra a funcionalidade de resumos em áudio para documentos em PDF, expandindo as capacidades do Gemini para Google Workspace. A ferramenta converte textos extensos em áudios curtos com linguagem natural, seguindo … Ler mais

Geração de Vídeo por Áudio com ComfyUI: Wan2.2 S2V

Descubra a geração de vídeo por áudio com ComfyUI usando Wan2.2 S2V. Transforme imagens estáticas em vídeos dinâmicos com qualidade cinematográfica. Saiba mais agora! O que é Wan2.2 S2V no ComfyUI? O Wan2.2 S2V representa um avanço significativo na geração de vídeo por inteligência artificial, agora com suporte nativo diretamente na plataforma ComfyUI. Trata-se de … Ler mais

A magia do podcast do NotebookLM chega ao Google Drive, permitindo que o senhor transforme seus longos PDFs em resumos de áudio

Todos nós temos esses arquivos no Google Drive: o relatório de 80 páginas do setor, a longa transcrição da reunião ou o contrato denso que o senhor quer ler. Passar esses arquivos pelo ChatGPT ou Gemini para criar um resumo de alto nível pode parecer uma boa ideia. Mas e se o senhor pudesse transformar … Ler mais

Gemini agora faz resumos em aúdio de PDF no Google Drive ABC do ABC

O Google Drive está implementando uma atualização significativa para quem lida com documentos longos. A plataforma agora utiliza o poder do Gemini para transformar arquivos PDF em resumos de áudio, com duração de dois a dez minutos. Esta novidade, disponível para assinantes de planos selecionados, foi anunciada na última terça-feira (11). LEIA MAIS: Google Fotos … Ler mais

Geração de Vídeo 1080P com Áudio

Descubra o Wan 2.5 no ComfyUI com geração de vídeos 1080P, sincronização áudio-visual, suporte multilíngue e preservação de identidade. Tutorial completo. O que é o Wan 2.5 e suas principais novidades O Wan 2.5 (preview) representa um salto significativo na geração de imagens e vídeos através de API nodes no ComfyUI. Esta versão preview introduz … Ler mais

O gerador de vídeo AI do Google está obtendo melhor edição e mais áudio

O Google está tornando os vídeos criados com a ferramenta de produção de filmes de IA Flow ainda mais realistas – e mais difíceis de identificar como gerados por IA à primeira vista. A empresa anunciou na quarta-feira que os usuários podem adicionar e alterar as sombras e a iluminação de seus vídeos de IA. … Ler mais

Novo Google Speaker com Gemini promete áudio espacial imersivo

O recente evento Made by Google trouxe à tona uma novidade intrigante: um Google Speaker impulsionado pela tecnologia Gemini. Este aparelho, ainda não oficialmente anunciado, promete funcionalidades que podem revolucionar sua experiência de áudio. Disponibilidade em quatro cores, com design inovador. Pareamento com Google TV Streamer para áudio espacial. Suporte completo ao Matter e novos recursos de voz … Ler mais

a mestria tecnológica da Google aplicada ao áudio

Aplicando a sua mestria tecnológica, a Google acaba de lançar os seus mais recentes auriculares. Os Pixel Buds Pro 2, os auriculares de topo assinados pela empresa, integram o Gemini, e combinam design, desempenho e inteligência.   Pixel Buds Pro 2 entregam o que de melhor a Google faz no áudio Os Pixel Buds Pro … Ler mais

Google treina o bot Gemini AI para gerar versões em áudio de documentos e reproduzi-los – Avalache Notícias

Os desenvolvedores do Google continuam usando o modelo Gemini AI para criar novos recursos que podem ser úteis aos usuários. Desta vez, o algoritmo aprendeu a “gerar versões em áudio dos seus documentos” armazenados no serviço de nuvem Google Docs, com a capacidade de reproduzi-los posteriormente por voz. Fonte da imagem: 9to5google.com Uma nova opção … Ler mais

PF confirma uso de inteligência artificial em áudio atribuído a candidato durante eleição em MG

Uma perícia técnica da Polícia Federal confirmou que um áudio atribuído ao então candidato a prefeito de Teófilo Otoni (MG), Tarcirlei Mariniello de Brito (PT), foi gerado por inteligência artificial. O laudo, produzido pelo Setor Técnico-Científico da Superintendência da PF na Bahia, analisou o arquivo que circulou nas semanas finais da campanha eleitoral de 2024 … Ler mais