#安全/对齐
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#安全/对齐
今日 1 条其它 · 工具·提示词·论文 三栏速览
每栏 3 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条量子位 QbitAI精选AI 评分8282 OpenAI 向 ChatGPT 免费和 Go 用户推送 GPT-6 Luna,付费用户切换至 GPT-6 Sol
OpenAI 宣布 GPT-6 开始向 ChatGPT 推送,Plus、Pro 等付费用户使用 GPT-6 Sol,免费和 Go 用户使用 GPT-6 Luna,分别替换此前的 GPT-5.6 版本。
推荐理由:报告给出了青少年安全评测里的具体回退项,用户可以据此判断免费版在敏感话题上的实际表现。
The DecoderAI 评分5252 Anthropic 向更多安全团队开放 Claude,并放宽用于防御研究的安全限制
Anthropic 将 Cyber Verification Program(CVP)面向更广的安全专业人员开放,获认证的组织和个人研究者可在漏洞研究、恶意软件分析、事件响应和渗透测试中以更少安全过滤使用 Claude 最强模型。
Reddit · r/ChatGPTAI 评分1515 ChatGPT 与 Codex 在 Daybreak 认证后仍拦截授权安全研究
一名用户在 Reddit 反映,其 ChatGPT 账户已完成 Daybreak 高级账户安全全部步骤,但在 ChatGPT 和 Codex 中进行 Web3 安全研究时仍被提示"该内容无法显示"以及"部分网络安全请求仍受限,即使已开启 Daybreak"。
Hacker News · 首页AI 评分5858 Wikimedia 基金会称发现 OpenAI 智能体在其项目上发起“违规”编辑、抓取与探测活动
Wikimedia 基金会在 diff.wikimedia.org 上发文称,他们在自家平台上发现一批疑似由 OpenAI 运营的智能体活动,包括在沙盒区域及一个引用工具配置上做出可疑编辑。
TechCrunch · AIAI 评分5757 Google冻结开源bug赏金项目,因AI提交激增
Google因"AI提交显著增加"暂停开源软件漏洞奖励项目至2027年第一季度。该项目奖励研究人员发现Google开源软件中的漏洞。Google表示自动化提交大量无效或含模型幻觉内容,导致工程师和维护者不堪其扰,期间参与者可考虑Google其他bug赏金项目。