pediatric-ai-scribe-v3/src/routes/tts.js
Daniel Onyejesi e6091c299f Fix TTS axios/Vertex, generic toast, add stop button to encounter
- TTS: switch from OpenAI SDK to axios (same fix as STT), drop voice
  param since it's configured inside LiteLLM per model
- Fix 'ElevenLabs unavailable' toast shown even when provider is LiteLLM
- Add dedicated red Stop button to encounter recording UI
2026-03-29 22:09:56 -04:00

68 lines
2.7 KiB
JavaScript

const express = require('express');
const router = express.Router();
const axios = require('axios');
const { authMiddleware } = require('../middleware/auth');
// TTS_PROVIDER=litellm → LiteLLM proxy (Vertex AI TTS, OpenAI TTS, etc.)
// TTS_PROVIDER=elevenlabs → ElevenLabs (not HIPAA)
// (auto) LITELLM_API_BASE set → litellm
// (auto) ELEVENLABS_API_KEY set → elevenlabs
function getTTSProvider() {
var env = process.env.TTS_PROVIDER;
if (env === 'litellm') return 'litellm';
if (env === 'elevenlabs') return 'elevenlabs';
if (process.env.LITELLM_API_BASE) return 'litellm';
if (process.env.ELEVENLABS_API_KEY) return 'elevenlabs';
return 'none';
}
var ttsProvider = getTTSProvider();
console.log('🔊 TTS provider:', ttsProvider);
router.post('/text-to-speech', authMiddleware, async (req, res) => {
try {
var text = (req.body.text || '').substring(0, 5000);
if (!text) return res.status(400).json({ error: 'No text provided' });
if (ttsProvider === 'litellm') {
if (!process.env.LITELLM_API_BASE) return res.status(400).json({ error: 'LITELLM_API_BASE not set.' });
var ttsModel = process.env.LITELLM_TTS_MODEL || 'tts-1';
var base = process.env.LITELLM_API_BASE.replace(/\/+$/, '');
var ttsHeaders = { 'Content-Type': 'application/json' };
if (process.env.LITELLM_API_KEY) ttsHeaders['Authorization'] = 'Bearer ' + process.env.LITELLM_API_KEY;
// Send only model + input — voice is configured inside LiteLLM per model
var ttsResp = await axios.post(base + '/v1/audio/speech', {
model: ttsModel,
input: text
}, {
headers: ttsHeaders,
responseType: 'arraybuffer',
timeout: 60000
});
res.set('Content-Type', 'audio/mpeg');
return res.send(Buffer.from(ttsResp.data));
}
if (ttsProvider === 'elevenlabs') {
if (!process.env.ELEVENLABS_API_KEY) return res.status(400).json({ error: 'ElevenLabs not configured' });
const response = await axios({
method: 'POST',
url: 'https://api.elevenlabs.io/v1/text-to-speech/pNInz6obpgDQGcFmaJgB',
headers: { 'xi-api-key': process.env.ELEVENLABS_API_KEY, 'Content-Type': 'application/json' },
data: { text: text, model_id: 'eleven_turbo_v2_5', voice_settings: { stability: 0.5, similarity_boost: 0.75 } },
responseType: 'arraybuffer'
});
res.set('Content-Type', 'audio/mpeg');
return res.send(Buffer.from(response.data));
}
res.status(400).json({ error: 'TTS not configured. Set LITELLM_API_BASE or ELEVENLABS_API_KEY.' });
} catch (err) {
console.error('[TTS] Error:', err.message);
res.status(500).json({ error: 'TTS failed: ' + err.message });
}
});
module.exports = router;