- SignalDesk1小时前
前置传送: SayKuku 之前一直用 Typeless 。额度降低后,我试了几款替代品,都没找到适合自己输入习惯的,就 Vibe Coding 了 SayKuku 。 想要的操作很简单:光标在哪儿,Fn 一下就在哪儿说话;选中一句话,Fn*2 ,还能直接让它改短或翻译。 现在有两个入口: 按 Fn 语音输入,识别结果尝试写回当前光标位置。可选按住说话或单击开关。 连按两次 Fn 打开 Voice Agent ,能按语音要求改写选区、翻译、提问、继续对话之类,也可以执行其他一些命令(比如你可以直接说输出《兰亭集序》)。 这是用 SwiftUI 和 AppKit 做的 macOS 15+ 原生 App ,1.0.2 的通用 DMG 是 4.8 MB ,同时支持 Apple 芯片和 Intel Mac 。Fn 手势、选区读取与跨 App 写回依赖辅助功能;写回前会核对目标。不同 App 的文本控件行为不一样,遇到不能写入或焦点跑掉的情况,欢迎告诉我 App 名称和复现步骤。 App 免费。需要自己配置阿里云百炼 API Key 。 当前用 Qwen3.8 Omni Flash 系列直接处理语音和指令,不走「先纯 ASR 、再交给另一模型」的固定两段流程,模型调用由自己的账号计费。按官方当前北京地域单价,默认实时模型的 1 小时音频输入约 0.15 元 ;输出文字、其他请求和地域差异另计,实际以账单为准。历史、记忆和可选录音留在本机,本地文件没有额外加密。 另外,计划代码整理好后开源。 传送门: SayKuku 配置指南
- 情报分类:技术学习与提效
- 分类依据:内容涉及技术、AI、软件工具或工程实践
- 信息来源:服务器 / V2EX
- 发布时间:2026/9/28 14:55:20
- 暂无回复