推出 Gemini 3.8 Live 与 3.8 Live Extended Thinking
今天我们推出两款新模型,在近实时推理方面带来进步,从而更有效地支持语音 agent,并让与 AI 的对话感觉更直观、更智能。
你好呀,正在用屏幕阅读器的朋友。这个网站的每个按钮和图片我都认真标注过,希望你逛得顺畅。有任何不方便的地方,页脚有我的邮箱,说了我就改。—— 店主
加载中…
按机构浏览
共 46 条
今天我们推出两款新模型,在近实时推理方面带来进步,从而更有效地支持语音 agent,并让与 AI 的对话感觉更直观、更智能。
今天,我们宣布推出新的前沿模型 Gemini 4 Argon,该模型正通过我们的 Fairwind Program 向一批受信任的网络防御者逐步开放。Argon 旨在支撑复杂、长周期工作流中的深度推理,正在从根本上改变我们在 Google 工作和构建的方式。它带来了前沿性能……
继上周 Gemini 3.8 Live 发布后的势头,今天我们很高兴推出带 Live Avatar 的 Gemini 3.8 Live——为我们的原生实时对话模型带来近乎实时的视觉呈现。通过将近乎实时的视频生成与语音相结合,Live Avatar 功能创造了一种体验,让用户……
AlphaGenome Atlas绘制了人类基因组中90亿个单字母DNA变体的分子效应图谱。
为 AI 生成的蛋白质添加水印并同时保持生物功能的概念验证。
为 Personal AI 的 Private AI Compute 引入私有的服务端内存。
我们去年推出了 EmbeddingGemma,旨在为高质量文本嵌入提供一种轻量级选择,帮助你的应用直接在消费级硬件上组织、搜索和连接信息。开发者社区的反馈远超我们的预期。其下载量已超过 2000 万次,构建者们已将其用…
官方来源未提供摘要,点开可查看原文。
每天,天气影响着数十亿个决策。有些决策很简单,比如出门前拿起雨伞,但另一些则重要得多。风、雨以及热浪和干旱等极端天气事件,对农业、全球供应链、清洁能源生产等产生连锁影响……
Google DeepMind与游戏工作室合作,原型化突破性的AI游戏玩法。
现在您可以通过Gemini 3.5 Transcribe获得更智能的语音转文字转录功能。
希望使用先进 AI 的防御者长期面临两难:采用庞大的前沿模型,这些模型部署成本高昂,且难以在企业代码库中控制;或者转向可能难以处理复杂漏洞修复的小型开放权重模型,并要求团队自行构建……
今天,我们在最新模型——Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite——中推出代理式视频理解能力。这项新功能在提高准确性的同时,大幅减少视频分析所需的 token 使用量和成本。与结合 Gemini 模型原生图像理解能力的类似代理式视觉功能相呼应……
在三个月前 3.7 Flash 成功的基础上,并在短短六周内推出我们的第三个 Flash 版本,今天我们推出 Gemini 3.8——这是我们迄今最好的推理和编码模型,同时保持了 3.7 的速度和低成本。Gemini 3.8 提供两个变体:
试点全球首个双盲AI评估
今天,我们推出 Gemini Omni 1.1 Flash,这是一套全新的创意控制和生成式视频功能,旨在为开发者提供支持。Gemini Omni 将现实世界推理引入生成式创作,而今天的更新使 Omni 1.1 通过 Google AI Studio 中的 Gemini API 为专业用途做好了生产准备。无……
生物学家利用Co-Scientist发现能够成功使人类细胞恢复活力的新因子。
今天,我们在广泛使用的Flash系列进展的基础上,推出Gemini 3.7 Flash,这是我们针对编码和智能体的最智能的主力模型。
我们正在扩展工具,帮助您理解网络上的内容是如何被创建和编辑的。
今天,Google DeepMind与A24宣布了一项开创性的研究合作。此次合作将世界领先的研究实验室与业内最具电影制作人导向的工作室相结合,帮助艺术家开发新的工作流程和技术。这确保了未来的工具由创作者塑造…
随机对照试验的结果显示了Gemini的引导学习功能在提升参与度和加速学习方面的潜力。
推出手语转文本(SL2T)模型,为聋人和听力障碍用户提供新的手语功能。
Google DeepMind及合作伙伴宣布为多智能体安全研究提供1000万美元的资金征集。
Google和AIM推出了ATL Saathi,一个由Gemini驱动的AI工具,为印度机器人实验室的教育工作者提供支持。
Google为Genesis Mission承诺4000万美元的AI代币和积分。
我们推出新的Gemini模型,包括Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber。
Gemini 3.5 Live Translate为Google AI Studio、Google Translate和Google Meet带来近乎实时的自然语音翻译。
Gemini Robotics ER 2帮助机器人进行推理、协作和解决现实任务。它代表了视频理解、工具编排和多机器人协作在机器人应用中的重大进步。
Google DeepMind和Isomorphic Labs正在分享我们关于生物弹性和AI模型的联合方法。
Google推出Gemini 3.5 Flash Cyber,一款轻量级网络安全模型,用于发现和修补漏洞。
亚太地区是全球经济增长的引擎,但也极易受到气候变化的影响。尽管绿色技术正在蓬勃发展,但最近的一份报告显示,其扩展速度不足以应对该地区日益增长的环境风险。
官方来源未提供摘要,点开可查看原文。
英国政府与Google DeepMind合作,构建一个新型AI驱动的原型,旨在加快住房决策。
计算机使用现在作为内置工具集成在Gemini 3.5 Flash中,为智能体计算机使用任务提供了我们最好的性能。此前仅作为独立的Gemini 2.5计算机使用模型提供,现在计算机使用已原生集成到主要的Gemini Flash模型中。Gemini已经在函数调用方面表现出色…
我们正将Google AI Ultra订阅扩展到全球用户,并推出由Street View驱动的新功能。
人工智能有潜力帮助解决世界上一些最大的挑战——不仅在数字领域,在物理世界中也是如此。机器人技术是人工智能最令人兴奋的前沿领域之一,语言、视觉和行动模型的进步可以帮助创造能够与现实世界互动的智能机器…
官方来源未提供摘要,点开可查看原文。
我们最新的音乐生成模型 Lyria 3.5 在音乐性、歌词和人声质量方面取得了重大进步,使您能够创作更丰富的曲目。我们今天在 Google Flow Music 中推出该模型,希望帮助您创作您喜爱的歌曲,并提供创意控制。
一系列科学工具和实验,旨在扩大科学探索的规模和精度。
去年,Nano Banana将Gemini的智能带到了图像生成和编辑中。自那时起,它已帮助数百万人修复旧照片、从草图设计以及以以前不可能的方式可视化想法。我们从一开始就将Gemini构建为原生多模态的,现在我们…
官方来源未提供摘要,点开可查看原文。
今天,我们通过两个重大发布,让您更快速、更轻松地实验、完善和扩展您的创意:
今天,我们推出Gemma 4 12B,这是我们最新的模型,旨在将智能体多模态智能直接带到笔记本电脑上。Gemma 4 12B在边缘友好的E4B和更先进的26B专家混合(MoE)之间架起桥梁,将强大的功能封装在更小的内存占用中。它也是我们…
通过结合传统防护措施与实时监控的AI控制路线图,保障内部系统安全。
今天,我们推出DiffusionGemma,这是一个实验性的开放模型,探索文本扩散——一种极快的文本生成方法。该模型以Apache 2.0许可证发布,是一个26B的专家混合(MoE)模型,超越了典型自回归大型语言模型逐词顺序处理的方式…
Google DeepMind 官方研究与产品动态;用于理解方向变化。