Dr. Claw / BloClaw:可审计、可追溯的"AI 科研工作台"
Dr. Claw (arXiv:2609.00365,2026-08-31):以人机协同 + 持久状态 + 技能库把规划-执行-写作变成一条可恢复、可审计的闭环,比裸 CLI 智能体完整度更高。 BloClaw (AI4S 工作站,2026
Dr. Claw (arXiv:2609.00365,2026-08-31):以人机协同 + 持久状态 + 技能库把规划-执行-写作变成一条可恢复、可审计的闭环,比裸 CLI 智能体完整度更高。 BloClaw (AI4S 工作站,2026
综述指出,高通量测序推动植物促生菌研究从培养依赖转向基因组信息策略,但准确识别与表征仍具挑战。 文章为综述,梳理基于基因组的大规模分类与功能分析,以及基于性状数据库对植物有益基因的预测途径。
arXiv:2609.05079 · 2026-09-04 · 预印本 40 个来自同行评审研究的盲任务(跨 10 个学科),只给目标与冻结数据、隐藏结论与路径;LLM 评委按 6 维证据成熟度打分。结果:4 个主流编码智能体挤在 58–6
Brazilian Journal of Health Aromatherapy and Essential Oil · 2026-09-08 · 综述 综述药物研发管线中计算技术的演进:从早期专家系统(DENDRAL)、计算机辅助药物设计
综述主张人工智能交互不等同于社会交互,需重新审视幼儿期人工智能介导的数字暴露。 该文为综述,因摘要缺失,具体检索策略、纳入文献与分析框架无法从现有信息获知。
arXiv:2606.29193 · AAAI Fall Symposium (ATRACC 2026) · 2026-09-09 · 预印本 提出 Telemetry Claim Adjudicator(TCA) :一种"机制式、无需结果
三种当代大语言模型在苯妥英与地高辛治疗药物监测解读上表现存在领域差异。 向Claude Sonnet 4.6、ChatGPT 5.5与Gemini 3.1 Pro提交30个结构化临床情景,由两名评分者盲法独立评分。
该综述考察机器学习算法预测心血管疾病风险的输出,是否针对Framingham风险评分的已知不足并改善风险估计。 检索Medline、Embase与IEEE自建库至2025年1月1日,纳入将机器学习心血管风险评估输出与FRS直接比较的研究,排除评论、信件及未发表文献。
针对肝胆胰肿瘤多学科决策场景,评估当代大语言模型治疗建议的稳定性及其与团队决策的一致性。 回顾性比较可行性研究,对相同肝胆胰肿瘤病例重复查询大语言模型,考察同一输入下输出是否一致,并与多学科团队决策比对。
研究提出并评估“检索后验证”方法,用于衡量大语言模型生成医学信息的证据支持度与幻觉。 针对AI生成医学信息缺乏源文档明确支持的问题,开展实证研究以直接评估其是否基于底层证据。