Row 11109

Row ID: 11109 | Dataset Entry | Axioma AXP Content Repository

Content Data

This page contains data entry 11109 from the Axioma AXP content repository. The structured data below represents the complete record for this entry.

Inspired by the launch of GPT-4o multi-modality I was trying to chain some models locally and make something similar. I ended up using Whisper.cpp, Phi-3-Mini on Llama.cpp, and ElevenLabs to convert the LLM reply to audio in near real-time. This is how it looks like [https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab\_channel=JustforBlogsHey%21](https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab_channel=JustforBlogsHey%21)

Read about my experiment here: [https://medium.com/towards-artificial-intelligence/whisper-cpp-llama-cpp-elevenlabs-local-gpt-4o-like-voice-heaven-b6c3c185d912](https://medium.com/towards-artificial-intelligence/whisper-cpp-llama-cpp-elevenlabs-local-gpt-4o-like-voice-heaven-b6c3c185d912)

FieldValue
text Inspired by the launch of GPT-4o multi-modality I was trying to chain some models locally and make something similar. I ended up using Whisper.cpp, Phi-3-Mini on Llama.cpp, and ElevenLabs to convert the LLM reply to audio in near real-time. This is how it looks like [https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab\_channel=JustforBlogsHey%21](https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab_channel=JustforBlogsHey%21) Read about my experiment here: [https://medium.com/towards-artificial-intell…
label r/openai
dataType post
communityName r/OpenAI
datetime 2024-05-20
username_encoded Z0FBQUFBQm5Lakw1aUlwUG9mQlRrUjRNN3gtazltQkVfNFFadjB3OGdvcUlDRWgyODVtVDRkZ3cyeVJOUnZucVFwdE9RX0ttR1FpRmdnU2JPSjR2WnRIZ1FpeXItQlBmdGxDZFl3dmZjcGtRaEs3S2N3N29MYW89
url_encoded Z0FBQUFBQm5Lak9KZG1Hb3JJeEVGSE1sTTBkX1NlbnpjaGYxZnI0SDFOQXEyMWxNOW41RHl2bHdwSWEyZEhMT0w3V2w5Y2VFRjROMWtjcDRNcDVPTzNGQ1BpTUo5QURIei14ZDZjQlplNmp2MGxMTDBDb1BJSEtQYmVWRjVWNXc0QU9BOFZYbnktZzhFc1FaaEtWUTRBS2FuWWlhZlNKTUVHS19Famg4T193TVRyOXRJR0hfZ1I2Q2ZKTFQzWTY1a2d4WExDRGVLUl9IQmQxcUhQNXJPY1pVSExRcXZpOWN0QT09

Raw Record

{
  "text": "Inspired by the launch of GPT-4o multi-modality I was trying to chain some models locally and make something similar. I ended up using Whisper.cpp, Phi-3-Mini on Llama.cpp, and ElevenLabs to convert the LLM reply to audio in near real-time. This is how it looks like [https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab\\_channel=JustforBlogsHey%21](https://www.youtube.com/watch?v=0-6LY9XJbZQ&ab_channel=JustforBlogsHey%21) \n\n  \nRead about my experiment here: [https://medium.com/towards-artificial-intelligence/whisper-cpp-llama-cpp-elevenlabs-local-gpt-4o-like-voice-heaven-b6c3c185d912](https://medium.com/towards-artificial-intelligence/whisper-cpp-llama-cpp-elevenlabs-local-gpt-4o-like-voice-heaven-b6c3c185d912)",
  "label": "r/openai",
  "dataType": "post",
  "communityName": "r/OpenAI",
  "datetime": "2024-05-20",
  "username_encoded": "Z0FBQUFBQm5Lakw1aUlwUG9mQlRrUjRNN3gtazltQkVfNFFadjB3OGdvcUlDRWgyODVtVDRkZ3cyeVJOUnZucVFwdE9RX0ttR1FpRmdnU2JPSjR2WnRIZ1FpeXItQlBmdGxDZFl3dmZjcGtRaEs3S2N3N29MYW89",
  "url_encoded": "Z0FBQUFBQm5Lak9KZG1Hb3JJeEVGSE1sTTBkX1NlbnpjaGYxZnI0SDFOQXEyMWxNOW41RHl2bHdwSWEyZEhMT0w3V2w5Y2VFRjROMWtjcDRNcDVPTzNGQ1BpTUo5QURIei14ZDZjQlplNmp2MGxMTDBDb1BJSEtQYmVWRjVWNXc0QU9BOFZYbnktZzhFc1FaaEtWUTRBS2FuWWlhZlNKTUVHS19Famg4T193TVRyOXRJR0hfZ1I2Q2ZKTFQzWTY1a2d4WExDRGVLUl9IQmQxcUhQNXJPY1pVSExRcXZpOWN0QT09"
}

Entry Information