Row 11109
Content Data
This page contains data entry 11109 from the Axioma AXP content repository. The structured data below represents the complete record for this entry.
Inspired by the launch of GPT-4o multi-modality I was trying to chain some models locally and make something similar. I ended up using Whisper.cpp, Phi-3-Mini on Llama.cpp, and ElevenLabs to convert the LLM reply to audio in near real-time. This is how it looks like [https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab\_channel=JustforBlogsHey%21](https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab_channel=JustforBlogsHey%21)
Read about my experiment here: [https://medium.com/towards-artificial-intelligence/whisper-cpp-llama-cpp-elevenlabs-local-gpt-4o-like-voice-heaven-b6c3c185d912](https://medium.com/towards-artificial-intelligence/whisper-cpp-llama-cpp-elevenlabs-local-gpt-4o-like-voice-heaven-b6c3c185d912)
| Field | Value |
|---|---|
| text | Inspired by the launch of GPT-4o multi-modality I was trying to chain some models locally and make something similar. I ended up using Whisper.cpp, Phi-3-Mini on Llama.cpp, and ElevenLabs to convert the LLM reply to audio in near real-time. This is how it looks like [https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab\_channel=JustforBlogsHey%21](https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab_channel=JustforBlogsHey%21) Read about my experiment here: [https://medium.com/towards-artificial-intell… |
| label | r/openai |
| dataType | post |
| communityName | r/OpenAI |
| datetime | 2024-05-20 |
| username_encoded | Z0FBQUFBQm5Lakw1aUlwUG9mQlRrUjRNN3gtazltQkVfNFFadjB3OGdvcUlDRWgyODVtVDRkZ3cyeVJOUnZucVFwdE9RX0ttR1FpRmdnU2JPSjR2WnRIZ1FpeXItQlBmdGxDZFl3dmZjcGtRaEs3S2N3N29MYW89 |
| url_encoded | Z0FBQUFBQm5Lak9KZG1Hb3JJeEVGSE1sTTBkX1NlbnpjaGYxZnI0SDFOQXEyMWxNOW41RHl2bHdwSWEyZEhMT0w3V2w5Y2VFRjROMWtjcDRNcDVPTzNGQ1BpTUo5QURIei14ZDZjQlplNmp2MGxMTDBDb1BJSEtQYmVWRjVWNXc0QU9BOFZYbnktZzhFc1FaaEtWUTRBS2FuWWlhZlNKTUVHS19Famg4T193TVRyOXRJR0hfZ1I2Q2ZKTFQzWTY1a2d4WExDRGVLUl9IQmQxcUhQNXJPY1pVSExRcXZpOWN0QT09 |
Raw Record
{
"text": "Inspired by the launch of GPT-4o multi-modality I was trying to chain some models locally and make something similar. I ended up using Whisper.cpp, Phi-3-Mini on Llama.cpp, and ElevenLabs to convert the LLM reply to audio in near real-time. This is how it looks like [https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab\\_channel=JustforBlogsHey%21](https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab_channel=JustforBlogsHey%21) \n\n \nRead about my experiment here: [https://medium.com/towards-artificial-intelligence/whisper-cpp-llama-cpp-elevenlabs-local-gpt-4o-like-voice-heaven-b6c3c185d912](https://medium.com/towards-artificial-intelligence/whisper-cpp-llama-cpp-elevenlabs-local-gpt-4o-like-voice-heaven-b6c3c185d912)",
"label": "r/openai",
"dataType": "post",
"communityName": "r/OpenAI",
"datetime": "2024-05-20",
"username_encoded": "Z0FBQUFBQm5Lakw1aUlwUG9mQlRrUjRNN3gtazltQkVfNFFadjB3OGdvcUlDRWgyODVtVDRkZ3cyeVJOUnZucVFwdE9RX0ttR1FpRmdnU2JPSjR2WnRIZ1FpeXItQlBmdGxDZFl3dmZjcGtRaEs3S2N3N29MYW89",
"url_encoded": "Z0FBQUFBQm5Lak9KZG1Hb3JJeEVGSE1sTTBkX1NlbnpjaGYxZnI0SDFOQXEyMWxNOW41RHl2bHdwSWEyZEhMT0w3V2w5Y2VFRjROMWtjcDRNcDVPTzNGQ1BpTUo5QURIei14ZDZjQlplNmp2MGxMTDBDb1BJSEtQYmVWRjVWNXc0QU9BOFZYbnktZzhFc1FaaEtWUTRBS2FuWWlhZlNKTUVHS19Famg4T193TVRyOXRJR0hfZ1I2Q2ZKTFQzWTY1a2d4WExDRGVLUl9IQmQxcUhQNXJPY1pVSExRcXZpOWN0QT09"
}
Entry Information
- Entry ID: 11109
- Repository: Axioma AXP
- Dataset: arrmlet/reddit_dataset_36
- Total Entries: 100,000