跳到正文

#教程/实践

今日 12 条

工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
10月4日周日
  1. Reddit · r/LocalLLaMA36

    本地 TTS 工具 Breeze 体验:结合 Opus 5.5 实现低延迟语音对话

    用户使用本地 TTS 工具 Breeze 结合 Opus 5.5 模型,实现语音对话功能。无思考模式延迟约 500ms,低思考模式延迟 1-1.5s,可通过 BLE 遥控器和无线麦克风坐在沙发上直接对话。系统能监控 Claude session 结束并用语音发送简短摘要,在超过 500k token 上下文后仍保持一致的 live session 记忆。

  2. Reddit · r/LocalLLaMA27

    JEV 与普通嵌入模型有何不同?

    JEV 是一个基于嵌入的意图路由器(embedding-based intent router),通过计算用户输入与预设示例意图之间的余弦相似度来路由任务。它使用 Ollama 运行 nomic-embed-text 模型生成嵌入向量,而非直接输出答案。

  3. Reddit · r/LocalLLaMA21

    哪个现代开源大语言模型最不谄媚?

    用户在 Reddit 社区询问当前最不具谄媚特性的开源权重模型,指出此前的 Kimi K2 和 GPT OSS 120b 已过时。谄媚特性对创意研究和智能体编程工作造成负面影响——前者会使用户陷入自身错误思路,后者则会降低模型发现代码 bug 的能力。

  4. Hacker News · 首页28

    用 Claude 自动化 35mm 胶片扫描流水线:从驱动扫描仪到负片转正、去尘与编辑

    摄影爱好者 Shan 用 Claude 接管了 35mm 胶片扫描流水线:先用 SANE 驱动扫描仪因方向反转险些损坏机械,改为在 VueScan 扫描后交接给 Claude 处理后续环节。Claude 通过 numpy 做负片密度反转并以片卷空白段为基准统一色彩,再用图像分析定位灰尘、用 LaMa 模型填补并从邻近颗粒补回细节,使原本每卷 36 张需约 4 小时的流程被自动化。

  5. Hacker News · 首页73

    如何用 C2PA '黑掉'时间戳

    安全研究员通过实验发现 C2PA 标准允许任意排除文件字节范围的特性,可构造排除整个文件的 Manifest,从而在图像上伪造可信的时间戳。研究者先拍摄彩票照片并获得合法时间戳,再在开奖后修改图像(p图),验证 C2PA 签名仍显示原始时间。研究者指出修复这一漏洞需要为每种文件格式明确限定允许排除的范围。

  6. Hacker News · 首页29

    如何用 UWB 技术追踪垃圾桶是否被搬出

    作者用超宽带(UWB)技术搭建了 BinRange 系统判断六个垃圾桶是否被搬出。该方案使用 Makerfabs ESP32-WROVER/DW3000 开发板作为 radio anchor 和标签,在 10 米距离测试中误差小于 2 厘米,户外可靠距离约 30 米。系统与 Home Assistant 集成,结合回收日程判断垃圾桶状态。

  7. Hacker News · 首页73

    如何在 Claude 和 Claude Code 中充分利用 Opus 5.5

    Anthropic 发布 Opus 5.5 使用指南,涵盖三大方面:提问技巧(给出明确完成标准、删除 think hard 提示、设计需求列出要避免的风格)、长时间运行管理(CLAUDE.md 配置何时停止或继续、用子任务拆分大型工作、在文件中维护任务清单)、结果检查(优先阅读模型需要你做什么、让模型标记未确认的信息)。

  8. Reddit · r/artificial20

    Swokei 如何帮助联系有糟糕网站的企业

    用户发现 Swokei 可以自动查找潜在客户并分析其网站问题,包括过时设计、加载速度慢、移动端体验差和 SEO 薄弱等。该工具根据分析结果生成人性化的冷邮件,而非枯燥的评分报告,使外展联系更加高效。对网页设计机构而言,这大大节省了手动 prospecting 和个性化沟通的时间。

  9. Reddit · r/ChatGPT33

    ChatGPT Airtable 插件使用体验分享

    一位 Reddit 用户分享了将 ChatGPT 与 Airtable 插件结合使用的体验,通过自然语言指令可自动从论坛、Reddit 等来源抓取数据并添加至 Airtable 表格,同时还能调用 sites skill 直接生成展示网站。用户表示其工作流程因此实现了高度自动化。

10月3日周六
  1. Reddit · r/LocalLLaMA63

    用本地 LLM 玩魔兽世界:开源项目展示

    作者搭建了一个魔兽世界私人服务器,并编写了浏览器客户端和 MCP Agent 工具,可通过 WebSocket 用 LLM 控制角色玩游戏。项目支持本地模型连接,24GB 内存可运行 Qwen3.8-27B-GPTQ-W4A16,16GB 内存推荐用 vLLM 加载自定义的 Gemma4-e4b-coder(约 200 tok/s)。

  2. Reddit · r/ChatGPT19

    ChatGPT 如何在新聊天中保持之前对话的上下文和语气?

    用户在ChatGPT中进行了超过1000条消息的长对话后,点击"New Chat"只能打开普通新聊天页面,无法保留原对话的上下文。曾让GPT总结对话并粘贴到新聊天中,但无法恢复原来的语气、温暖和友好等特征。当前ChatGPT尚无法在不同会话间传递完整的对话上下文和风格设置。

  3. Reddit · r/artificial18

    AI 模型成本究竟从何而来?

    Reddit 用户质疑 Claude Opus 5.5 定价低于 Opus 5.0、Astra 和 Fable,不理解成本差异的真正来源,猜测定价可能基于硬件成本而非实际效率。用户认为直接调整旧版本价格即可实现降价,无需推出新版本。

  4. Hacker News · 首页52

    在 M4 Mac mini 上启动 Linux 的历程

    作者记录了在 M4 Mac mini 上成功启动 Linux 的完整过程。M4 是首款强制启用 SPTM 的 Apple Silicon 芯片,作者依次解决了 GXF 功能锁定、MMU 初始化时的 MMIO 映射、CPU 寄存器访问权限、以及 WFI 指令导致寄存器状态丢失等问题。

9月29日周二
  1. AWS Machine Learning Blog48

    如何在 SageMaker AI 上用 vLLM-Omni 生成图像和视频(下篇)

    在 Amazon SageMaker AI 上使用 vLLM-Omni 容器部署两个端点,通过文本提示词生成静态图像(FLUX.2-klein-4B 实时端点),再将该图像作为条件输入生成视频(Wan2.1-VACE-1.3B 异步端点)。图像直接返回,视频生成完成后从 Amazon S3 检索 MP4 文件,示例包含命令行工作流和 Streamlit 界面。

9月28日周一
  1. AWS Machine Learning Blog55

    使用 Amazon Nova Act 实现合成监控

    Amazon Nova Act 使用多模态大语言模型处理 UI 截图而非 DOM 选择器,能自适应大部分 UI 变化。该方案结合 Amazon Bedrock AgentCore Runtime 实现无服务器执行,提供完整的示例代码仓库,包含部署脚本和 CDK 基础设施代码。

9月27日周日
9月26日周六
  1. AWS Machine Learning Blog60

    在 AWS SageMaker HyperPod 上使用 SkyRL 加速多模态 RL 训练

    本文详细介绍了在 Amazon SageMaker HyperPod 上使用开源 SkyRL 框架训练多模态强化学习模型的全流程,包括构建容器镜像、从 SageMaker Studio 启动 Ray 集群、提交训练任务、监控进度以及托管推理服务。

    推荐理由:给出了完整的操作流程和实验数据,读者可以据此在 SageMaker HyperPod 上复现多模态 RL 训练。

9月25日周五
  1. GitHub Blog · AI & ML67

    GitHub Security Lab 发布 Taskflow Agent:实现 AI 驱动的自动化模糊测试

    GitHub Security Lab 发布 Fuzzing Taskflow,这是一个基于 LLM Agent 的 C/C++ 项目自动化模糊测试管道。只需指定一个 GitHub 仓库,Agent 会自动完成入口点识别、构建系统分析、模糊测试用例生成、AFL++ 运行、覆盖率分析、用例优化和漏洞报告编写。

    推荐理由:原文详细给出了自动化模糊测试的完整工作流程,包括覆盖率反馈循环、结构感知变异和语料库演进等具体机制,读者可据此迁移到自己的安全测试中。