<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	
	xmlns:georss="http://www.georss.org/georss"
	xmlns:geo="http://www.w3.org/2003/01/geo/wgs84_pos#"
	>

<channel>
	<title>Arquivos Automatic Speech Recognition | Tecnoveste</title>
	<atom:link href="https://www.tecnoveste.com.br/tag/automatic-speech-recognition/feed/" rel="self" type="application/rss+xml" />
	<link>https://www.tecnoveste.com.br/tag/automatic-speech-recognition/</link>
	<description>Notícias de tecnologia, ciência, empreendedorismo e cultura digital</description>
	<lastBuildDate>Sun, 02 Jul 2023 20:26:55 +0000</lastBuildDate>
	<language>pt-BR</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.0</generator>

<image>
	<url>https://i0.wp.com/www.tecnoveste.com.br/wp-content/uploads/2021/01/cropped-tec.png?fit=32%2C32&#038;ssl=1</url>
	<title>Arquivos Automatic Speech Recognition | Tecnoveste</title>
	<link>https://www.tecnoveste.com.br/tag/automatic-speech-recognition/</link>
	<width>32</width>
	<height>32</height>
</image> 
<site xmlns="com-wordpress:feed-additions:1">122013697</site>	<item>
		<title>Whisper da Open AI: o que é, para que serve e como funciona</title>
		<link>https://www.tecnoveste.com.br/whisper-da-open-ai-o-que-e-para-que-serve-e-como-funciona/</link>
					<comments>https://www.tecnoveste.com.br/whisper-da-open-ai-o-que-e-para-que-serve-e-como-funciona/#respond</comments>
		
		<dc:creator><![CDATA[Paulo Edson]]></dc:creator>
		<pubDate>Thu, 13 Jul 2023 08:58:22 +0000</pubDate>
				<category><![CDATA[Assistente Pessoal & Inteligência artificial]]></category>
		<category><![CDATA[Programação]]></category>
		<category><![CDATA[Tecnologias]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[Automatic Speech Recognition]]></category>
		<category><![CDATA[comunicação]]></category>
		<category><![CDATA[criptografia]]></category>
		<category><![CDATA[espionagem]]></category>
		<category><![CDATA[ia]]></category>
		<category><![CDATA[inteligência artificial]]></category>
		<category><![CDATA[interceptação]]></category>
		<category><![CDATA[privacidade]]></category>
		<category><![CDATA[Reconhecimento Automático de Fala]]></category>
		<category><![CDATA[Reconhecimento de Fala]]></category>
		<category><![CDATA[segurança]]></category>
		<category><![CDATA[Whisper]]></category>
		<guid isPermaLink="false">https://www.tecnoveste.com.br/?p=28157</guid>

					<description><![CDATA[<p>Whisper é um sistema de Automatic Speech Recognition (ASR) treinado em 680.000 horas de dados supervisionados multilíngues e multitarefas coletados na web. Ele funciona como um sistema de comunicação privado e foi desenvolvido pela OpenAI. O objetivo do Whisper é permitir que as pessoas se comuniquem de forma segura e privada, sem se preocupar com [&#8230;]</p>
<p>O post <a href="https://www.tecnoveste.com.br/whisper-da-open-ai-o-que-e-para-que-serve-e-como-funciona/">Whisper da Open AI: o que é, para que serve e como funciona</a> apareceu primeiro em <a href="https://www.tecnoveste.com.br">Tecnoveste</a>.</p>
]]></description>
										<content:encoded><![CDATA[<p><a href="https://openai.com/research/whisper" class="broken_link">Whisper</a> é um sistema de Automatic Speech Recognition (ASR) treinado em 680.000 horas de dados supervisionados multilíngues e multitarefas coletados na web. Ele funciona como um sistema de comunicação privado e foi desenvolvido pela OpenAI. O objetivo do Whisper é permitir que as pessoas se comuniquem de forma segura e privada, sem se preocupar com a interceptação de suas mensagens por terceiros.</p>
<p>ASR significa <strong>Reconhecimento Automático de Fala</strong>, que é a tecnologia usada para converter a linguagem falada em texto escrito. Os modelos ASR da OpenAI têm o potencial de serem usados em uma ampla gama de aplicativos, desde serviços de transcrição até assistentes de voz e muito mais. Leia o <a href="https://www.tecnoveste.com.br/wp-content/uploads/2023/05/Open-AI-White-Paper-Robust-Speech-Recognition-via-Large-Scale-Weak-Supervision.pdf">Whipe Paper do Whisper</a>.</p>
<p>&nbsp;</p>
<p>&nbsp;</p>
<div class="ui-block ui-block--code-snippet">
<p>&nbsp;</p>
<div class="mt-spacing-7">
<div class="container">
<div class="md:w-6-cols lg:ml-2-cols lg:w-6-cols relative">
<section class="flex flex-col" data-v-1090a973="">
<div class="flex justify-between" data-v-1090a973=""><span class="block f-heading-5" data-v-1090a973="">Whisper examples:</span><select data-v-1090a973=""><!--[--><option value="micromachines" data-v-1090a973="">Speed talking</option><option value="k-pop" data-v-1090a973="">K-Pop</option><option value="multilingual" data-v-1090a973="">French</option><option value="accent" data-v-1090a973="">Accent</option><!--]--><br />
</select></div>
<div class="my-24 flex items-center" data-v-1090a973="">
<p>&nbsp;</p>
<div class="opacity-40 transition-all duration-500 group-hover:opacity-100" data-v-1090a973="">
<div class="layer" data-v-1090a973=""></div>
<div class="layer" data-v-1090a973=""></div>
<div class="layer" data-v-1090a973=""></div>
<div class="layer" data-v-1090a973=""></div>
</div>
<div class="relative bg-[#fff] w-full h-full rounded-full flex items-center justify-center text-[#51da4c]" data-v-1090a973=""></div>
<p>&nbsp;</p>
<div class="relative w-full" data-v-1090a973="">
<div class="soundwave soundwave--unplayed js-soundwave" data-v-1090a973=""></div>
<div class="soundwave soundwave--played js-soundwave" style="clip-path: polygon(0px 0px, 100% 0px, 100% 100%, 0px 100%);" data-v-1090a973=""></div>
</div>
</div>
<div class="flex flex-col" data-v-1090a973="">
<p><button class="ui-button relative inline-block px-16 xs:pt-9 xs:pb-10 lg:pt-10 lg:pb-12 xxl:pt-8 xxl:pb-10 h-44 lg:h-48 border border-primary text-primary hover-hover:hover:bg-inverse hover-hover:hover:text-inverse active:bg-inverse active:text-inverse" style="display: none;" type="button" data-v-1090a973=""><span class="flex items-center justify-center"><!--[-->Reveal transcript<!--]--></span></button></p>
<div class="f-body-1 p-spacing-3 bg-[color:var(--gray-100)]" data-v-1090a973=""></div>
</div>
<p><audio class="hidden" src="https://cdn.openai.com/whisper/draft-20220920a/multilingual.wav" data-v-1090a973=""></audio></p>
</section>
</div>
</div>
</div>
<p>&nbsp;</p>
</div>
<p>&nbsp;</p>
<h2>Como funciona o Whisper</h2>
<p>O Whisper utiliza técnicas de criptografia avançadas para proteger as comunicações dos usuários. As mensagens são criptografadas antes de serem enviadas e só podem ser descriptografadas pelo destinatário pretendido. Além disso, as chaves de criptografia são geradas automaticamente e exclusivamente para cada usuário, garantindo que apenas o destinatário possa ler as mensagens.</p>
<p>O sistema de comunicação Whisper é parte integrante do ecossistema de inteligência artificial da OpenAI e tem como objetivo fornecer uma plataforma segura para que os usuários possam se comunicar e compartilhar dados sensíveis com confiança.</p>
<p>&nbsp;</p>
<h2>Utilidades do Whisper da Open AI</h2>
<div class="group w-full text-gray-800 dark:text-gray-100 border-b border-black/10 dark:border-gray-900/50 bg-gray-50 dark:bg-[#444654]">
<div class="text-base gap-4 md:gap-6 md:max-w-2xl lg:max-w-xl xl:max-w-3xl p-4 md:py-6 flex lg:px-0 m-auto">
<div class="relative flex w-[calc(100%-50px)] flex-col gap-1 md:gap-3 lg:w-[calc(100%-115px)]">
<div class="flex flex-grow flex-col gap-3">
<div class="min-h-[20px] flex flex-col items-start gap-4 whitespace-pre-wrap break-words">
<div class="markdown prose w-full break-words dark:prose-invert dark">
<p>O Whisper, sistema de reconhecimento automático de fala da OpenAI, pode ter várias aplicações práticas para empresas e marcas. Por exemplo, é possível usá-lo para transcrever áudio em tempo real durante reuniões, eventos ou entrevistas. Isso economiza tempo e recursos que seriam gastos na transcrição manual. Além disso, o Whisper pode ser usado para criar assistentes de voz personalizados para empresas, o que melhora a experiência do usuário e aumenta o engajamento com a marca.</p>
<p>A tecnologia também pode ser usada para análises de sentimentos em áudios de atendimento ao cliente, fornecendo informações valiosas sobre o desempenho da equipe e a satisfação do cliente. Além disso, o Whisper também está sendo utilizado internamente pela equipe da OpenAI como uma ferramenta de comunicação para manter a segurança e a privacidade de suas próprias informações confidenciais.</p>
</div>
</div>
</div>
</div>
</div>
</div>
<p>Embora ainda esteja em fase experimental, o Whisper tem o potencial de se tornar uma ferramenta importante para indivíduos e organizações que precisam de um meio seguro e confiável de comunicação. Com o aumento da conscientização sobre a privacidade dos dados, a demanda por soluções seguras de comunicação só deve crescer no futuro.</p>
<p>&nbsp;</p>
<h2>Qual é o limite de produção de Whisper?</h2>
<p>Qualquer comprimento de áudio é aceitável, desde que o tamanho do arquivo de entrada seja inferior a 25MB. Então, há uma relação inversamente proporcional na qualidade do áudio produzido e o tempo de duração do arquivo final.</p>
<p>O usuário pode fazer até 50 solicitações por minuto.</p>
<p>&nbsp;</p>
<h2>Quais são os idiomas que o Chat GPT fala pelo Whisper?</h2>
<p>Afrikaans, Árabe, Armênio, Azerbaijano, Bielorrusso, Bósnio, Búlgaro, Catalão, Chinês, Croata, Tcheco, Dinamarquês, Holandês, Inglês, Estoniano, Finlandês, Francês, Galego, Alemão, Grego, Hebraico, Hindi, Húngaro, Islandês, Indonésio, Italiano, Japonês, Canarês, Cazaque, Coreano, Letão, Lituano, Macedônio, Malaio, Marathi, Maori, Nepali, Norueguês, Persa, Polonês, Português, Romeno, Russo, Sérvio, Eslovaco, Esloveno, Espanhol, Swahili, Sueco, Tagalo, Tamil, Tailandês, Turco, Ucraniano, Urdu, Vietnamita e Galês.</p>
<p>&nbsp;</p>
<p>&nbsp;</p>
<h3>Quais formatos de arquivo são suportados pelo Whisper?</h3>
<ul>
<li>m4a</li>
<li>mp3</li>
<li>webm</li>
<li>mp4</li>
<li>mpga</li>
<li>wav</li>
<li>mpeg</li>
</ul>
<p>O post <a href="https://www.tecnoveste.com.br/whisper-da-open-ai-o-que-e-para-que-serve-e-como-funciona/">Whisper da Open AI: o que é, para que serve e como funciona</a> apareceu primeiro em <a href="https://www.tecnoveste.com.br">Tecnoveste</a>.</p>
]]></content:encoded>
					
					<wfw:commentRss>https://www.tecnoveste.com.br/whisper-da-open-ai-o-que-e-para-que-serve-e-como-funciona/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		<enclosure url="https://cdn.openai.com/whisper/draft-20220920a/multilingual.wav" length="4038734" type="audio/wav" />

		<post-id xmlns="com-wordpress:feed-additions:1">28157</post-id>	</item>
	</channel>
</rss>
