借助Gemini 3.5 Live Translate实现流畅自然的语音翻译
Gemini 3.5 Live Translate为Google AI Studio、Google Translate和Google Meet带来近乎实时的自然语音翻译。
你好呀,正在用屏幕阅读器的朋友。这个网站的每个按钮和图片我都认真标注过,希望你逛得顺畅。有任何不方便的地方,页脚有我的邮箱,说了我就改。—— 店主
加载中…
可搜索 · 可筛选 · 可追溯
每条信息都保留来源、核验时间和适用条件。用方向、难度、参与形式与截止时间,找到现在真正能做的事。
已启用 1 项筛选
第 8 / 14 页 · 共 335 条
Gemini 3.5 Live Translate为Google AI Studio、Google Translate和Google Meet带来近乎实时的自然语音翻译。
GitHub Copilot 应用的新用户?了解如何启动项目、与 AI 智能体协作、探索画布,并简化你的开发工作流程。本文《GitHub Copilot 应用初学者指南:入门》最初发布在 GitHub 博客上。
结构化输出是大语言模型最常见的现实任务之一,然而大多数基准测试将其归入更广泛的推理或提取分数中,而不是单独衡量。模型能否可靠地返回符合请求格式和形状的有效、可解析输出(即模式合规性),往往决定了它是否能被实际使用。
Radisson 与 Accenture 合作,利用 OpenAI 技术构建了一个 ChatGPT 插件,帮助旅客在规划行程时查找、比较和预订酒店。
Gemini Robotics ER 2帮助机器人进行推理、协作和解决现实任务。它代表了视频理解、工具编排和多机器人协作在机器人应用中的重大进步。
今年早些时候,《软件会遗忘:代理痕迹即记忆》一文指出,编程代理已经产生了我们不断丢失的记录。当它们搜索代码库、尝试不同方法、遇到错误、阅读文档并改变方向时,它们留下的不仅是更改了什么,还有为什么更改的丰富记录。
OpenAI 就涉及澳大利亚政府网站的事件致歉,并概述了更完善的保障措施与支持,以加强澳大利亚的网络防御。
Google DeepMind和Isomorphic Labs正在分享我们关于生物弹性和AI模型的联合方法。
8月23日,Surya Narreddi 发布了一段由语言模型绘制水彩画的精美视频。该模型通过 p5.brush(一个为 p5.js 添加自然绘图工具的库)编写 JavaScript 代码。视频迅速走红,截至撰写本文时已有超过150万次观看。
借助 GPT-5.6、GPT-6 Astra 和 GPT‑Image‑2.5,Pollo AI 帮助创作者将大胆创意转化为精细图像和电影级视频广告。
Google推出Gemini 3.5 Flash Cyber,一款轻量级网络安全模型,用于发现和修补漏洞。
今天我们推出 BenchMIRT,一种在单个提示级别(即模型被评分的具体问题和任务)审计 LLM 基准测试的新方法。
借助 Codex、GPT-Live-1 和 GPT-6 Astra,Proaction 能够更快速地构建、运营和销售现代车队管理方案。
官方来源未提供摘要,点开可查看原文。
今天,我们发布了这项工作的第一部分:@huggingface/kernels,一个用于从 HF Mirror Hub 加载和运行优化 WebGPU 内核的精简库,同时提供了位于 hf-mirror.com/webgpu-kernels 的初始207个内核集合。
Wayfair 使用 OpenAI 模型改进电商支持与商品目录准确性,自动化工单分类,并大规模提升数百万商品属性。
英国政府与Google DeepMind合作,构建一个新型AI驱动的原型,旨在加快住房决策。
基准测试决定了什么会被构建。在开放ASR排行榜上得分高的模型会被采用并持续迭代,而排行榜未衡量的能力往往得不到改进。最近排行榜上的许多工作都投入在使评估指标更加可靠上:
庆祝 OpenAI Academy 成立两周年,并将 AI 技能带给更多社区。
计算机使用现在作为内置工具集成在Gemini 3.5 Flash中,为智能体计算机使用任务提供了我们最好的性能。此前仅作为独立的Gemini 2.5计算机使用模型提供,现在计算机使用已原生集成到主要的Gemini Flash模型中。Gemini已经在函数调用方面表现出色…
实际部署很少符合话题级别的图景。同一个基础模型可能被适配用于通用助手、教育产品、企业系统或公共部门服务,每种场景在相同话题内需要不同边界。公民教育导师和公共部门助手可以共享一个模型……
借助 GPT-6 Astra,invideo 能以更高精度规划剪辑,将色彩校正与调色效率提升三倍,并在一天内产出 50 个自定义特效。
人工智能有潜力帮助解决世界上一些最大的挑战——不仅在数字领域,在物理世界中也是如此。机器人技术是人工智能最令人兴奋的前沿领域之一,语言、视觉和行动模型的进步可以帮助创造能够与现实世界互动的智能机器…
微调多向量模型涉及多个组件:模型本身、数据集、损失函数、训练参数、评估器和训练器类。我将逐一检查这些组件,并附上用于微调强大多向量模型的实用示例。