谷歌正式发布 Gemini 3.5 Flash 的「Computer Use」功能,使模型能直接操控真实操作系统界面——通过视觉理解屏幕内容、调用本地应用(如Excel、Chrome、Terminal)、执行点击/输入/滚动等操作,并支持跨工具链式任务(例如从网页抓取数据→在表格中分析→生成可视化图表)。该能力基于强化学习与动作空间建模,延迟低于800ms,已在Workspace Labs中开放测试。区别于传统RPA或API集成,它无需预设脚本或开发者介入,代表AI Agent向具身智能迈出关键一步;但当前仅限受控环境启用,暂未开放通用API,且对图形界面一致性要求较高。
Gemini 3.5 Flash 模型
model Gemini 3.5 FlashAI 辅助整理 · 事实字段按公开来源校验
Gemini 3.5 Flash 是 Gemini Flash 系列模型候选,采集标题提到 computer use 能力,适合作为模型词条继续跟踪。
事实字段
category
model
confidence
medium
reviewed_by
codex-current-session
source_candidate_name
Computer use in Gemini 3.5 Flash
来源追溯:
事实字段来自公开来源整理;字段级来源元数据待继续补齐,无法稳定核验的信息不做臆测。
整理说明
本页围绕「定位、事实字段、演进时间线、关联动态」组织信息,方便快速判断 Gemini 3.5 Flash 模型 在 AI Agent 与大模型生态中的位置。
事实型字段保持保守:未公开或无法稳定核验的信息不做臆测;关联动态保留原始来源链接,便于继续阅读。