#开源/仓库
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#开源/仓库
今日 1 条音频 · 工具·提示词·论文 三栏速览
每栏 5 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Product HuntAI 评分4141 Tonefold:开源 AI 音乐作曲工具,支持 MIDI/WAV/stems 导出
Tonefold 是一款面向 macOS 和 Windows 的免费开源 AI 音乐作曲工具,用户向 Claude 描述歌曲后即可在钢琴卷帘中生成和弦、旋律、贝斯和鼓,并支持逐音符编辑,最终导出 MIDI、WAV 和 stems 文件。
Reddit · r/LocalLLaMAAI 评分2929 Ruach Studio 发布首个 RC,本地 GPU 打造 YuE2 全流程歌曲工作室
Ruach Studio 围绕 m-a-p 开源歌曲模型 YuE2 推出首个 RC 版本,用户在一张 RTX 3090 上即可本地完成最长 8 分钟的作曲、演唱与渲染,6:12 的歌曲约 126 秒、7:25 配 ABC 乐谱的歌曲约 198 秒生成。
Reddit · r/LocalLLaMAAI 评分4646 Cactus Whistle:16.9MB 超小体积 ASR 模型,文件大小仅为 Whisper base 的 1/9
Cactus Compute 发布 Whisper 同类自动语音识别模型 Whistle,权重开源,文件仅 16.9MB,约为 Whisper base(145.3MB)的 1/9。
Reddit · r/LocalLLaMAAI 评分4545 Speakrail:单张 RTX 4090 即可运行的全本地低延迟语音助手
开发者发布开源全本地全双工语音助手 Speakrail,在单张 RTX 4090 上运行,组件包括 Voxtral Realtime 语音识别、Gemma 4 12B 微调大语言模型和 Breeze TTS 2 语音合成。该项目在部分基准测试中可比肩 GPT-Live,并支持插话、静默与打断等全双工交互模式。作者表示后续将发布完整技术报告。
Reddit · r/LocalLLaMAAI 评分3434 Lokutor 团队发布 ItoTTS:面向 $5 ESP32-S3 的自然语音 TTS 引擎,单个声部权重仅 4.89 MB
Lokutor 团队发布面向 ESP32-S3 的流式 TTS 引擎 ItoTTS,提供两个 24 kHz 英语人声,单个声部权重仅 4.89 MB,目标是让本地大语言模型在 $5 芯片上获得语音输出。