#arXiv
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#arXiv
今日 0 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/MachineLearningAI 评分1818 AFP-GIC:可控生成式图像压缩框架在 IEEE Access 发表
AFP-GIC 框架发表于 IEEE Access(2026),针对超低码率场景,通过非对称自适应融合先验迁移管道,在不传输融合先验的前提下实现先验引导的纹理重建。
Reddit · r/MachineLearningAI 评分5252 用于动力学系统零样本重建的极简可解释架构
NeurIPS 2026 论文提出名为 DynaBase 的极简架构,仅使用一个参数 α 控制局部收敛/发散率,配合上下文选择器从给定信号中选取最近邻数据点,即可重建固定点(α<1)、极限环(α=1)和混沌吸引子(α>1)等不同动力学状态。
Hacker News · 首页AI 评分7373 arXiv 更新速率限制政策:每位作者每月最多提交 2 篇
arXiv 从 2026 年 10 月 1 日起实施新的速率限制政策,每位作者每月最多提交 2 篇论文,最多同时保持 3 篇活跃提交。该政策旨在应对 AI 工具普及导致的提交量激增问题:2026 年 9 月 arXiv 收到 40,363 篇论文,较两年前翻倍,产生近 9,000 张工单,低质量论文占用了志愿者版主大量时间。
Hugging Face BlogAI 评分5959 ProvenanceGuard:针对 MCP 智能体的源感知事实验证
ProvenanceGuard 是一个后生成验证层,用于检测 MCP 智能体答案中的跨源混淆问题。当一个声明的事实存在于某个证据中,但被错误地归因到另一个来源时,源盲目验证器会通过,但源感知验证器不会。
Unbug 一分钟读论文AI 评分3636 AgentPProf:面向长程 AI 智能体的语义性能分析工具
2026 年 9 月 14 日提交到 arXiv 的论文《AgentPProf》提出,把系统软件的 profiling 方法移植到长程 AI 智能体上,以任务意图而非代码路径作为归因单位,像查 CPU 热点一样定位长任务中消耗资源的具体步骤。
Product Hunt · AI 分类AI 评分4949 Curie:面向科研的 AI 研究助手
Curie 并行搜索 PubMed、arXiv、Europe PMC、OpenAlex 和 Semantic Scholar,验证每个结论的来源,标注哪些有据可查、哪些缺乏支持。文档可提取结构化数据,每个值附带原始引用;支持完整的系统综述、筛选和 PRISMA 流程图,每步需用户审批。内置项目管理和文献库功能保持研究有序。
Import AIAI 评分4747 Import AI 467: 自我复制AI病毒概念验证;AI进步将推高计算成本
多伦多大学、Vector Institute、剑桥大学和ServiceNow研究人员构建了首个使用开源LLM的自我复制AI病毒,可在单张A100 GPU上运行,漏洞检测成功率约80%,漏洞利用约53%,自我复制约88%,整体攻击成功率约37%,证明自我驱动的网络威胁已不再是理论。研究人员警告需为自主生成式对抗 agent 做好准备。域名注册
Berkeley AI Research精选AI 评分6060 ABBEL:通过信念状态实现高效长程交互
本文提出 ABBEL 框架,通过将交互历史压缩为自然语言信念状态来替代完整上下文,从而降低长程任务的计算成本。在协同编码任务 CollabBench 中,使用基于重建的信念评分(belief grading)可将性能差距缩小约 50%,训练步数从 100 降至 50,峰值 token 减少 57%。该方法在组合锁游戏和多目标问答任务中也展现了学习效率优势。
推荐理由:给出了具体性能数据(性能差距缩小50%、训练步数减半、峰值token大幅降低),读者可以直接评估这个方法对长程交互任务的实际价值。