<?xml version="1.0" encoding="utf-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Recent changes to Home</title><link>https://sourceforge.net/p/kaldi/wiki/Home/</link><description>Recent changes to Home</description><atom:link href="https://sourceforge.net/p/kaldi/wiki/Home/feed" rel="self"/><language>en</language><lastBuildDate>Tue, 11 Sep 2018 07:43:32 -0000</lastBuildDate><atom:link href="https://sourceforge.net/p/kaldi/wiki/Home/feed" rel="self" type="application/rss+xml"/><item><title>Discussion for Home page</title><link>https://sourceforge.net/p/kaldi/wiki/Home/?limit=25#8529/74c6/d512</link><description>&lt;div class="markdown_content"&gt;&lt;p&gt;Sorry Dan..&lt;br/&gt;
I'll make my question clear to you.&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;Using kaldi is it possible to translate a stram of 6-8 hours audio into text?&lt;/p&gt;
&lt;/blockquote&gt;&lt;/div&gt;</description><dc:creator xmlns:dc="http://purl.org/dc/elements/1.1/">shashi</dc:creator><pubDate>Tue, 11 Sep 2018 07:43:32 -0000</pubDate><guid>https://sourceforge.net82435941719432e4c340e9af5b1b2ff800903ac5</guid></item><item><title>Discussion for Home page</title><link>https://sourceforge.net/p/kaldi/wiki/Home/?limit=25#8529</link><description>&lt;div class="markdown_content"&gt;&lt;p&gt;Hello,&lt;br/&gt;
Can Any one provide the limitations for kaldi usage such as, how it works on realtime data?&lt;br/&gt;
can we stream data for 6-8 hours?&lt;br/&gt;
speaking recoginization based on time window?&lt;/p&gt;&lt;/div&gt;</description><dc:creator xmlns:dc="http://purl.org/dc/elements/1.1/">shashi</dc:creator><pubDate>Mon, 10 Sep 2018 11:12:41 -0000</pubDate><guid>https://sourceforge.net5b35d3bf50353b395a809672c642166e42d2690b</guid></item><item><title>Discussion for Home page</title><link>https://sourceforge.net/p/kaldi/wiki/Home/?limit=25#ce02</link><description>&lt;div class="markdown_content"&gt;&lt;p&gt;Thanks for helping out&lt;br/&gt;
Is there any other thing i can try to reduce WER % ?&lt;/p&gt;&lt;/div&gt;</description><dc:creator xmlns:dc="http://purl.org/dc/elements/1.1/">Vaibhav</dc:creator><pubDate>Thu, 05 Jul 2018 05:36:14 -0000</pubDate><guid>https://sourceforge.net46c3d3764840d366d0fe69c9f98457e0af248336</guid></item><item><title>Discussion for Home page</title><link>https://sourceforge.net/p/kaldi/wiki/Home/?limit=25#cbd2</link><description>&lt;div class="markdown_content"&gt;&lt;p&gt;I saw wrong  file Sorry .&lt;br/&gt;
It was 40 &lt;/p&gt;
&lt;p&gt;How can i improve accuracy ?&lt;/p&gt;&lt;/div&gt;</description><dc:creator xmlns:dc="http://purl.org/dc/elements/1.1/">Vaibhav</dc:creator><pubDate>Wed, 04 Jul 2018 08:03:31 -0000</pubDate><guid>https://sourceforge.net647066e3958a8a560c8778c769d1a4bf4fc2a6ac</guid></item><item><title>Discussion for Home page</title><link>https://sourceforge.net/p/kaldi/wiki/Home/?limit=25#e2c9</link><description>&lt;div class="markdown_content"&gt;&lt;p&gt;testing speakers are different&lt;br/&gt;
phone set size = 170&lt;br/&gt;
Yes , testing words exist in the the 1400 words&lt;/p&gt;&lt;/div&gt;</description><dc:creator xmlns:dc="http://purl.org/dc/elements/1.1/">Vaibhav</dc:creator><pubDate>Wed, 04 Jul 2018 06:54:01 -0000</pubDate><guid>https://sourceforge.netb0f885d53d2cbd1d8f9b6864d5ec82cbe3225bdc</guid></item><item><title>Discussion for Home page</title><link>https://sourceforge.net/p/kaldi/wiki/Home/?limit=25#0681</link><description>&lt;div class="markdown_content"&gt;&lt;p&gt;28 speakers for training and 4 for testing &lt;br/&gt;
90 minutes training data .&lt;br/&gt;
vocab size is 1400 words training .&lt;br/&gt;
I had trained using mono ,  tri1 , tri2 , tri3 and sgmm models but all are giving wer in range 55-65&lt;/p&gt;&lt;/div&gt;</description><dc:creator xmlns:dc="http://purl.org/dc/elements/1.1/">Vaibhav</dc:creator><pubDate>Wed, 04 Jul 2018 06:43:27 -0000</pubDate><guid>https://sourceforge.nete63889c7d50a25e669c485d45908f2cd40281d6d</guid></item><item><title>Discussion for Home page</title><link>https://sourceforge.net/p/kaldi/wiki/Home/?limit=25#f0bc</link><description>&lt;div class="markdown_content"&gt;&lt;p&gt;i am not using any standard database .&lt;br/&gt;
I am having my own dataset of Punjabi language which is tonal language . So i thought it would be good to add pitch features with mfcc but the results are not good with or without pitch features .&lt;br/&gt;
What can i do ?&lt;/p&gt;&lt;/div&gt;</description><dc:creator xmlns:dc="http://purl.org/dc/elements/1.1/">Vaibhav</dc:creator><pubDate>Wed, 04 Jul 2018 06:17:32 -0000</pubDate><guid>https://sourceforge.nete8bc048ec68cf4ddacdb54e0bd75d65abaf68f88</guid></item><item><title>Discussion for Home page</title><link>https://sourceforge.net/p/kaldi/wiki/Home/?limit=25#3bb3</link><description>&lt;div class="markdown_content"&gt;&lt;p&gt;I am facing one more issue sir &lt;/p&gt;
&lt;p&gt;I had run mfcc + pitch script with multiple available options&lt;br/&gt;
--add-pov-feature , --add-normalized-pitch etc .&lt;br/&gt;
but i am getting a WER % of about 55-60 %&lt;br/&gt;
Please suggest what can i do ?&lt;/p&gt;
&lt;p&gt;Thanks&lt;/p&gt;&lt;/div&gt;</description><dc:creator xmlns:dc="http://purl.org/dc/elements/1.1/">Vaibhav</dc:creator><pubDate>Wed, 04 Jul 2018 05:46:24 -0000</pubDate><guid>https://sourceforge.netfd1ff51a9bd7f0cab206e52e0a20658ef479fc47</guid></item><item><title>Discussion for Home page</title><link>https://sourceforge.net/p/kaldi/wiki/Home/?limit=25#e249</link><description>&lt;div class="markdown_content"&gt;&lt;p&gt;Ok Thanks for your help sir &lt;/p&gt;&lt;/div&gt;</description><dc:creator xmlns:dc="http://purl.org/dc/elements/1.1/">Vaibhav</dc:creator><pubDate>Wed, 04 Jul 2018 05:42:54 -0000</pubDate><guid>https://sourceforge.net649960d9de2141c3b4857ffbb625c513df398736</guid></item><item><title>Discussion for Home page</title><link>https://sourceforge.net/p/kaldi/wiki/Home/?limit=25#1e82</link><description>&lt;div class="markdown_content"&gt;&lt;p&gt;Hi &lt;/p&gt;
&lt;p&gt;I wanted to know that where i can found the script to extract pitch features only . &lt;br/&gt;
I know there is script for mfcc + pitch and plp + pitch features . &lt;br/&gt;
But i am unable to find the script to extract only pitch features .&lt;/p&gt;
&lt;p&gt;Thanks&lt;/p&gt;&lt;/div&gt;</description><dc:creator xmlns:dc="http://purl.org/dc/elements/1.1/">Vaibhav</dc:creator><pubDate>Tue, 03 Jul 2018 10:00:14 -0000</pubDate><guid>https://sourceforge.nete216e63408ba513b1599e430b6a66dc2e65dd9e7</guid></item></channel></rss>