Google发布Gemini 3.8 Live,加入实时Avatar交互↗
Google DeepMind介绍Gemini 3.8 Live及Live Avatar功能,为Gemini对话式AI加入接近实时的视觉呈现能力,强化了用户与模型进行面对面式交互的体验。
往期日报17 条新闻08:30 更新
Google DeepMind介绍Gemini 3.8 Live及Live Avatar功能,为Gemini对话式AI加入接近实时的视觉呈现能力,强化了用户与模型进行面对面式交互的体验。

LangSmith宣布LangSmith Engine v2加入Red Teaming功能,可主动发现Agent问题,并提供自动化Agent测试能力,用于验证Agent行为和可靠性。

LangSmith Custom Apps允许用户围绕LangSmith数据创建自定义界面,并将其发布到工作区,同时由平台处理托管、身份验证和权限配置。

GitHub Security Lab介绍如何使用基于Taskflow Agent AI框架的新模糊测试taskflow,用于组织和执行应用安全测试任务,探索Agent在漏洞发现与软件安全分析中的应用。

GitHub介绍在Copilot中使用canvas的交互方式,面向需要比聊天框更具实体感和可操作性输出的开发任务,展示了AI编程助手从对话界面向工作空间扩展的方向。
论文介绍JAZ代理框架,以单一LLM原语invoke为核心,并允许模型编写包含递归invoke的可执行代码;输入和交互历史均作为代码环境中的变量提供。作者以此探索仅依靠代理循环、提示和内置钩子完成复杂工作流的可行性。
Canary接收代码变更、预期行为和团队知识后,在远程沙盒中部署Agent集群,调查潜在故障并测试运行时问题。其验证范围包括单元测试、端到端测试、静态分析、运行实验和形式化验证。
Public Browser 3.0通过CDP连接真实Chrome,支持多标签页、脚本接口和MCP工具。候选材料称其在30项测试中相较多个浏览器工具减少调用、Token、成本和耗时,但数据来自项目方自测。
GitHub仓库 NVIDIA/Model-Optimizer 汇集量化、蒸馏、剪枝、神经架构搜索和推测解码等模型优化技术,用于压缩模型并优化下游推理部署速度。
GitHub仓库 leejet/stable-diffusion.cpp 使用纯C/C++实现扩散模型推理,支持Stable Diffusion、Flux、Wan、Qwen Image和Z-Image等模型。
GitHub仓库 vectorize-io/hindsight 提供一种可学习的Agent记忆系统,用于帮助Agent积累和利用历史信息。
GitHub仓库 rohitg00/ai-engineering-from-scratch 面向AI工程学习者,围绕学习、构建和交付AI项目提供实践内容。
NVIDIA讨论生物基础模型采用混合专家架构进行高效训练的方法。文章指出,相比每个token都经过全部层的稠密Transformer,MoE可通过稀疏激活降低模型扩展成本。

研究比较了代码本核验、回答分歧问题和提供标注理由三种专家反馈方式。基于辅导课程转录数据,标注理由方案准确率为64.9%,回答问题为60.5%,均高于专家直接修订代码本的57.8%。
EduBehaviors提出一种利用LLM识别可观察行为、再训练分类器的教育数据标注框架,在TalkMoves数据集上取得0.673宏平均F1和0.688 Cohen’s kappa,并发布配套工具包。
GitHub Enterprise Cloud现在可要求成员在执行高影响操作前完成交互式重新认证或多因素挑战。该功能扩展了GitHub现有的sudo机制,用于降低高权限操作被误用或劫持的风险。

PyTorch宣布在2026年北美大会增加Introduction Track,并推出PyTorch Associate Training,内容聚焦从研究原型到企业基础设施所需的端到端PyTorch实践能力。