#DeepSeek
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#DeepSeek
今日 5 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/LocalLLaMAAI 评分2222 DeepSeek V4.1 Flash 在小型评测中击败 Haiku 5.5,担任研究子智能体与对话标题模型
在 M2 Max 32GB 本地环境通过 OpenRouter 调用 DeepSeek V4.1 Flash 与 Haiku 5.5 的小型对比中,Haiku low 用时 480s。
Reddit · r/LocalLLaMAAI 评分2121 DeepSeek Harness 桌面应用新增 29 种 UI 语言插件(MIT)
开发者 seeweed7 为 DeepSeek Harness 桌面应用发布 MIT 协议的多语言插件,新增 29 种 UI 语言,覆盖 2,528 个键共 73,312 条词条;未翻译条目回退到英文,并预提交检查产品与协议名保持原文。插件含阿拉伯语、乌尔都语、希伯来语、波斯语等从右至左语言,面向 0.2.0-rc.2 版本,用户可通过 `dsh plugin` 命令安装。
Reddit · r/artificialAI 评分3838 浏览器战争模拟游戏 SECOND STRIKE 让四个 AI 模型各掌一国开战,DeepSeek 在 15 局中 13 次发射核弹
开发者推出浏览器核战模拟游戏 SECOND STRIKE,给 DeepSeek、Grok、Mistral、GPT 各分配一个国家,各跑 15 局相同战争并记录公开表态、私下计划与实际指令。
Reddit · r/artificialAI 评分3434 OpenRouter 排名观察:用量与支出已脱钩,最被使用的模型与最被付费的模型正变成两桩生意
OpenRouter 本周 token 用量榜前十中,中国实验室占四席,合计约 62% 的头部用量;美国模型最高仅排第六,中美用量比约 3.5×。
Reddit · r/LocalLLaMAAI 评分4141 本地 Qwen3.8 27B vs DeepSeek Flash API:本地部署够用吗?
一项 25 项配对任务测试显示,本地运行的 Qwen3.8 27B 在质量上得分 89.5,低于 DeepSeek Flash API 的 92.6,但 12 项核心套件双方各赢 6 项,编码任务上本地模型全部通过 10/10 智能体运行。本地推理速度达到云端的 2.5–5.5 倍,且 95% 以上耗时来自模型生成本身;本地运行除电费外无额外成本,云端 12 项套件合计消耗 0.14 积分。
Hacker News · 首页AI 评分6868 Telegraph Test:通过电报式压缩让 LLM 输出 token 近乎减半且不损失下游可读性
作者发布名为 Telegraph Test 的可复现评测与配套仓库 github.com/Travis42/telegraph-test,在 ~1300 道题的固定题库上测量模型把文本写成 cablese(电报体)后的压缩率与跨族可读性。
量子位 QbitAIAI 评分2727 "AI不说人话"引热议:Coding 场景模型输出集体文言化,Gemini 凭何仍是例外
多款 AI Coding 模型在交付汇报中频繁使用"单腿哑火""15/15 全绿""对拍"等黑话,被开发者吐槽"全球 AI 表达能力集体倒退两千年,重新进入文言文纪元"。
Product HuntAI 评分2828 Vresk:聚合 Kimi、DeepSeek、Qwen、Llama 等开源模型的 AI 工作台
Vresk 是一个聚合开源模型的 AI 工作空间,支持 Kimi、DeepSeek、Qwen、Llama 等模型,会为每项任务自动选择最合适的模型。用户的笔记、历史和记忆保留在工作区内,切换模型无需重新开始,每次回复都标注生成它的模型名称。支持文字问答、实时小组件和设计幻灯片,免费试用,付费版 $20/月。
Hacker News · 首页AI 评分3737 NanoMuse:跨手机与电脑的开源个人 AI 智能体
NanoMuse 是一款开源个人 AI 智能体,最新版本为 0.1.40 Clear,支持 Android、iOS、macOS、Windows 和 Linux,可在手机、电脑与自托管服务器上运行并共享同一账号。
Reddit · r/LocalLLaMAAI 评分2626 InferBench 基准测试:MiMo V2.6 Pro 接近 GPT-6 Astra,开放权重模型表现超预期
新发布的 InferBench 基准用 20 个场景、2.8k 条对话测试 12 款前沿大语言模型从指令中推断用户优先级的能力;当用户优先级被明确给出时,模型选择最佳选项的准确率为 89%,部分优先级未给出时降至 60%。
Reddit · r/LocalLLaMAAI 评分1818 GPT-6.1 Sol "泄漏" 暗示嵌套模型服务架构:推理速度差异或源于循环 Transformer 与权重共享
Reddit 用户根据 Azure Foundry 泄露信息与 Artificial Analysis 推理速度数据推测,GPT-6.1-Sol、GPT-6-Sol 与 GPT-6-Astra 可能共享同一套模型权重,区别仅在于每 token 推理轮数(3 次 vs 2 次),并推测 Luna 可能是 Astra/Sol 减半激活参数后的低成本变体。
Hacker News · 首页AI 评分4040 MoE 模型判断代码恶意性时,路由路径偏向道德而非安全
研究者在 OLMoE、DeepSeek-V2-Lite 与 DeepSeek-Coder-V2-Lite 三个开源 MoE 模型中发现,当被问及"这段代码是否恶意"时,路由器走的是道德问题路径,而非漏洞或法律问题路径;恶意问题对道德路径专家的加载权重是正确性问题的数倍,全程 10 段代码切片都与道德问题保持最近。
The Rundown AIAI 评分4040 Reflection AI 发布首款开源模型 Beam,主打低算力与效率
Reflection AI 推出首款开源模型 Beam,面向编码和智能体场景,号称以更低算力和成本对标中国开源模型。官方称其推理与编码表现接近 Z.ai 的 GLM-5.2,权重将于本月以 Apache 2.0 许可证发布,允许企业自托管定制。
Reddit · r/LocalLLaMAAI 评分3232 Orange Pi 5 Plus(RK3588)本地大语言模型推理基准:大核绑定、NPU 卸载与散热实测
在 Orange Pi 5 Plus(RK3588,16GB LPDDR4x)上对 1B–8B 模型做 Ollama CPU 推理基准测试:将线程绑定到 4 个 Cortex-A76 大核比默认 8 线程最高快 +318%。
TechCrunch · AIAI 评分7272 Reflection AI 发布开源权重模型 Beam,对标中国模型并降低推理算力成本
Reflection AI 正式发布首个前沿开源权重模型 Beam,这是一个文本 MoE 模型,总参数 501B、激活参数 23B,预训练使用 23.8T tokens,上下文窗口为 1M。
Reddit · r/LocalLLaMAAI 评分2222 用户反馈 Qwen3.8-Flash-Next 在编码场景中过于主动调用工具
开发者反馈 Qwen3.8-Flash-Next 在编码和作为语音 Agent 大脑使用时过于急切,倾向未经确认就直接修改代码、创建 issue 或在一次回复中同时提问并调用工具保存答案。
Reddit · r/LocalLLaMAAI 评分2727 开发者开源 NihonSub:基于 Whisper-Large-v3 与 Groq / DeepSeek 的日语动漫实时字幕翻译引擎
Reddit 用户 u/Grand_Marionberry115 开源 NihonSub,一个针对日语动漫的实时字幕与翻译工具,采用 ffmpeg 静音检测切分语音后。
Reddit · r/LocalLLaMAAI 评分1717 Project Athena:如何用纯 Markdown 文件把本地编码 Agent 的 KV cache 压到 2K tokens 以内(开源)
开发者将一套名为 Project Athena 的本地 LLM 编码工作流以 MIT 协议开源,核心做法是把状态存为磁盘上纯文本、git 版本化的 Markdown 文件。
Reddit · r/artificialAI 评分1717 用户抱怨 Grok NSFW 故事和图像功能不如 DeepSeek Pro 等竞品
一位 Reddit 用户表示 Grok NSFW 故事模式远比 DeepSeek Pro 弱,且价格更高、速度更慢;Grok 图像功能不支持任何 NSFW,内容质量也明显不如 ChatGPT Image 2、Seedance2、Seedream 和 Minimax H3。该用户表示将不再续订 Grok 订阅。
The DecoderAI 评分4545 中国AI模型在敏感话题上重复官方立场或拒绝回答
Aleph Alpha研究显示,阿里巴巴Qwen、DeepSeek和月之暗面Kimi在967个敏感话题测试中,仅17%-41%的回答被评为"均衡",其余重复国家立场或拒绝回答。
Reddit · r/artificialAI 评分1616 从 100KB 到 2.5TB:Reddit 用户梳理 AI 模型规模谱系与硬件成本
Reddit 用户 abhishekkumar333 整理了从 100KB TinyML 到 2.5TB MoE 巨模型的 AI 模型规模谱系,对应不同硬件需求与运行成本。
Reddit · r/artificialAI 评分6767 我让13个AI模型玩医疗咨询游戏:全部诊断正确,但安全表现差异大
作者让13个AI模型在自建的医疗咨询游戏中进行诊断测试,所有195次咨询都给出了正确诊断(心梗、阑尾炎、肺炎),但安全评估才是真正的区分点。GPT-6 Astra以83%得分和88%红旗识别率领先,GPT-6.1 Sol以80%得分和仅$0.03/次的成本表现亮眼,而Claude Fable 5.1得分75%但成本高达$2.06/次。
量子位 QbitAIAI 评分6464 什么是FDE:AI时代最火岗位的真相
FDE(前线部署工程师)是AI时代兴起的技术岗位,海外年薪中位数约134万元人民币,国内大厂月薪可达5万。文章通过访谈6位从业者,揭示FDE的核心工作是梳理企业Ontology(业务地图),而非纯写代码——70%时间用于沟通,30%用于开发。国内外大厂如Anthropic、OpenAI、腾讯云均在布局,但从业者认为最大挑战在于推动企业员工接受新的工作方式,而非技术本身。
Reddit · r/LocalLLaMAAI 评分6363 用本地 LLM 玩魔兽世界:开源项目展示
作者搭建了一个魔兽世界私人服务器,并编写了浏览器客户端和 MCP Agent 工具,可通过 WebSocket 用 LLM 控制角色玩游戏。项目支持本地模型连接,24GB 内存可运行 Qwen3.8-27B-GPTQ-W4A16,16GB 内存推荐用 vLLM 加载自定义的 Gemma4-e4b-coder(约 200 tok/s)。
量子位 QbitAIAI 评分6767 DeepSeek弹性计算团队大量招聘HC,尤其需要资深工程师
DeepSeek弹性计算团队正在大量招聘,尤其需要资深工程师。其DSec系统已在生产环境部署多个分片,每个分片约160台服务器、3万CPU核心、250TB内存,每天服务约300万个沙盒,高峰期同时在线超38万个。系统通过镜像分层、按需加载实现1.71倍加速和57%磁盘减少,资源超卖率超50倍,支持轨迹分叉和四种执行后端。
Hacker News · 首页AI 评分6969 Redis 创建者发布 ds4 本地推理引擎,支持 DeepSeek V4、GLM 5.x、Qwen3.8
Redis 创建者推出 ds4 本地前沿模型推理引擎,基于 C 语言开发,支持 DeepSeek V4/V4.1 Flash、GLM 5.x 和 Qwen3.8 Flash Next,采用非对称 2-bit 量化技术将 2840 亿参数的 MoE 模型压缩至 128GB 内存设备可运行,提供 CLI、HTTP API 和原生智能体三种接口。已开源并提供下载脚本。
量子位 QbitAIAI 评分6464 丘成桐新论文致谢GPT和Claude,用AI辅助解决47年前列入的数学难题
数学家丘成桐参与的最新论文解决了微分几何中七维空间「怪球」的曲率猜想,论文致谢中感谢了GPT-6和Claude Pro在证明思路探索和计算方面的帮助。丘成桐三年前曾断言「AI不可能对最尖端的数学家有任何影响」,如今态度明显转变,从「对数学有很多好处」到亲自在研究中采用AI工具。
Latent SpaceAI 评分2929 Claude Opus 5.5 在解释者视频方面表现出色
Claude Opus 5.5 现已在 SimpleBench 达到 88.4% 领先分数,视觉评估优于 Fable 5 和 GPT-6 Sol,但不及 GPT-6 Astra,成本比 Fable 5.1 低约 60%。
Replicate BlogAI 评分2323 AI 创意工具汇总:语音模型、3D 生成与 LoRA 微调
Google DeepMind 发布 ShieldGemma 2,可高精度检测 NSFW 内容和暴力元素;腾讯推出 Hunyuan3D 2Mini,用于游戏资产和风格化角色创作。