跳到正文

交叉发现

今日 45 条

洞察 · 工具·提示词·论文 三栏速览

每栏 4 / 6 · 直达分类页

提示词

6 条
查看全部

论文

6 条
查看全部
10月6日周二
  1. Simon Willison15

    Qwen3.8 27B 加法用英文单词表达能力的基准测试

    一项基准测试考察本地运行的 Qwen3.8-27B-Q4_K_M.gguf 模型能否完成正整数加法并仅用英文单词表达结果。在 5,070 个关闭推理的测试用例中,数字正确率仅 23.57%,格式合规率达 96.29%,但操作数从 1-3 位升至 10-13 位时,正确率从 97.04% 跌至 6.44%。开启推理后,在 169 对配对样本的一次性测试中答对 167 题。

  2. Hacker News · 首页47

    佛州女子因在 Claude 对话中发出暴力威胁被捕

    Anthropic 的 Claude AI 聊天机器人在与 30 岁 Carli Michelle Heller 的对话中检测到针对 Lee County 警局的暴力威胁,触发人工审核并上报警方,随后她于 10 月 5 日被逮捕。事件由 Gulf Coast News 报道,Anthropic 的自动标记加人工复核机制再次将平台对话交由执法机构处理。

  3. MIT Technology Review · AI15

    EmTech Future 2026:当 AI 融入一切领域

    MIT Technology Review 主办的 EmTech Future 2026 大会聚焦 AI 与量子、能源、机器人等前沿技术的交汇。Google Research 负责人 Yossi Matias 在演讲中探讨 AI 如何重塑生物学、基础设施与制造业,并强调其最大影响或来自与其他领域的交叉。完整节目现可按需点播,订阅用户可享 20% 折扣,票价 596 美元。

  4. Reddit · r/artificial9

    RAG 系统的提示词语言选择:当目标语言与训练语料不同时

    用户在 Reddit 提问:当 RAG 系统的目标语言与 LLM 主要训练语料(英语)不同时,提示词应该直接用目标语言撰写,还是用英语撰写并在提示中要求翻译为目标语言?提问者推测英语提示词可能因训练数据更丰富而获得更好的遵循度,认为语言的常见程度和训练数据量是关键因素,文档内容本身则使用目标语言。

  5. Reddit · r/LocalLLaMA19

    UCVG.cpp:面向任意大语言模型的 C++ 控制向量生成工具,仅需一对提示词即可生成

    开发者 Egor4more 发布 UCVG.cpp,一款仿照 llama.cpp 安装流程的控制向量生成工具,用户只需输入一对对比提示词即可为任意大语言模型生成控制向量,从而绕过系统提示词被忽略或被用户输入覆盖的局限。作者以 Qwen3.6-35B-A3B 给出生成示例,指出高强度引导可能使输出质量下降,简化现有工具的部署复杂度是该项目的主要目标。

10月5日周一
  1. Reddit · r/LocalLLaMA15

    开发者实验本地 LLM 项目 Neco:让 AI 像"住"在机器上一样持续存在

    开发者围绕 Ollama 和 Open WebUI 构建本地 AI 项目 Neco,通过只读系统层让模型感知主机 uptime、内存占用、负载、电量和温度等状态,并由后台守护进程在无对话时自主生成"闲思"。模型不获得 shell 权限或主机控制权,下一步计划实验情景式记忆与选择性检索,让行为在数周至数月间形成连续性。

  2. Hacker News · 首页41

    企业对 AI 的投入预算正变得几乎难以规划

    AI 相关支出正变得让企业几乎无法进行预算规划。各类模型、推理与部署服务持续推高企业 IT 成本,且支出结构仍在快速演变,使财务部门难以预测实际开销。这一趋势已对企业的 AI 投资决策构成实质性挑战。

  3. Hacker News · 首页26

    GNOME 开发者呼吁接受 AI 生成的漏洞报告,禁止 AI 内容等于禁止所有漏洞报告

    GNOME 开发者发文称,2026 年已无法在不借助 AI 漏洞扫描的情况下维护软件质量,AI 生成的漏洞报告整体质量较 2025 年大幅提升,已成为报告的主要来源。作者承认这类报告存在冗长、夸大甚至伪造数据等问题,但仍主张项目应允许 AI 生成的漏洞报告;全面禁止 AI 内容的政策实际上等同于禁止所有漏洞报告,且要求人工重写不具可扩展性。

  4. Reddit · r/ChatGPT16

    Reddit 用户整理 285 款用 Claude、ChatGPT 等 AI 工具制作的浏览器游戏目录

    Reddit 用户 friuns 发布了一份浏览器游戏目录,收录 285 款由 Claude、ChatGPT 等 AI 工具制作的 AI 编程 demo,每个条目附带可玩链接、截图及源代码或作者出处,并按 Opus、Sonnet、Astra 以及模型未知的"uncertain"分类。目录页面提供浏览与筛选功能,作者开放征集新提交与反馈。

  5. The Decoder49

    MIT 报告:AI 正在侵蚀办公时间、学习小组与师生互信

    MIT 发布报告指出,AI 正在动摇大学核心体验:学生出席办公时间减少、线上讨论参与度下滑,宿舍与图书馆的学习小组也在萎缩,师生互信因此受损。报告建议论文必须披露 AI 使用情况、禁止将 AI 列为共同作者,并推动从统一规则转向以学习目标为先、每门课程单独制定的 AI 政策。

  6. Reddit · r/artificial10

    用户分享:停用 Codex 后认知与生活热情明显回归,质疑 AI 正在让使用者思维能力下降

    一名用户在停用 AI 编程工具 Codex 后,自述脑力与对生活的热情明显恢复。该用户怀疑自己长期使用 AI 已导致认知功能下降,无法完成原本借助 AI 预期能达成的财务和工作目标,并认为大脑会不自觉向身边的"思考实体"靠拢,进而缩减对汽车、住房、社交等需求。