LangChain
大模型应用开发框架,可用于学习工具调用、检索与智能体工程。
你好呀,正在用屏幕阅读器的朋友。这个网站的每个按钮和图片我都认真标注过,希望你逛得顺畅。有任何不方便的地方,页脚有我的邮箱,说了我就改。—— 店主
加载中…
按主题浏览
共 75 条
大模型应用开发框架,可用于学习工具调用、检索与智能体工程。
大模型推理引擎,适合想弄清 KV cache 与批处理调度的人。
LlamaIndex在llama-index-integrations下为每个供应商提供一个集成包,仅面向LLM的就有上百个,因此OpenAILike与之并列:当某个托管服务始终没有专属的集成包时,你可以将它指向一个base URL,并自行设置is_chat_model等参数。里面的docstring示例……
在llama-index-core 0.14.24、通过aiosqlite使用SQLite、macOS arm64、Python 3.12环境下,使用开放的MIT测试套件agmi(https://github.com/tech4biz-yasha/agmi,行llamaindex-memory-sqlite)测得。方法:通过Memory.aput_messages()初始化一个会话,直接对llama_index_memory表进行一次编辑,不使用任何键,打开一个……
Chatham Financial 使用 Codex 和 GPT-5.6 构建技术并重新设计 workflows,将交易验证时间从 30 分钟缩短至 4 分钟以内。
借助 GPT-6 Astra,invideo 能以更高精度规划剪辑,将色彩校正与调色效率提升三倍,并在一天内产出 50 个自定义特效。
使用 GPT-5.6,Ringg 为覆盖语音、聊天、WhatsApp 和网页的多语言 agent 提供支持,成本相比 GPT-4.1 降低 90%。
GPT-6 Astra 完成一份含 50 个标签页的税务工作簿的速度是 GPT-5.6 Sol 的两倍,并且其对用户意图的更强理解让 Basis 在实际应用中更有信心。
了解 GPT-6 如何通过更高的缓存命中率、新的诊断功能、显式断点以及可降低延迟和成本的控制手段来改进提示缓存。
GPT-6 Astra 能生成结构更清晰、更具上下文感知的法律文档,让律师得以专注于策略。
今天我们推出两款新模型,在近实时推理方面带来进步,从而更有效地支持语音 agent,并让与 AI 的对话感觉更直观、更智能。
了解初创企业如何选择 GPT-6 模型、调整推理力度、优化提示词和技能、协调工具,并为生产环境准备 workflows。
探索 OpenAI DevDay 2026 上发布的 20 多项公告,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。
与之前的模型相比,GPT‑6 Astra 使 Parallel 的 agent 能够以一半的时间和一半的成本研究并综合劳动力市场数据。
了解 Airbnb 如何扩大对 GPT-6 Astra 和 OpenAI 前沿模型的访问,以帮助工程团队解决 bug、设计系统并更快交付。
借助 GPT-6 Astra,Higgsfield AI 让小企业更轻松地制作视频广告,并更快地将新的创意工具推向市场。
今天,我们宣布推出新的前沿模型 Gemini 4 Argon,该模型正通过我们的 Fairwind Program 向一批受信任的网络防御者逐步开放。Argon 旨在支撑复杂、长周期工作流中的深度推理,正在从根本上改变我们在 Google 工作和构建的方式。它带来了前沿性能……
认识 GPT-6 Sol 和 Luna,这两个模型以不同的能力与成本平衡,将前沿智能带入日常工作。
借助 Codex、GPT-Live-1 和 GPT-6 Astra,Proaction 能够更快速地构建、运营和销售现代车队管理方案。
继上周 Gemini 3.8 Live 发布后的势头,今天我们很高兴推出带 Live Avatar 的 Gemini 3.8 Live——为我们的原生实时对话模型带来近乎实时的视觉呈现。通过将近乎实时的视频生成与语音相结合,Live Avatar 功能创造了一种体验,让用户……
认识GPT-6.1 Sol:接近Astra的智能水平,适用于编程、计算机使用和专业工作,其标准API输入和输出token价格仅为Astra的五分之一。
Asana 在 Codex 中使用 GPT-6 Astra,使浏览器 agent 在测试中成本降低 76 倍、速度提升 5 倍,从而为客户提供能力更强的模型。
如果病理学基础模型能够以更少的资源完成更多工作会怎样?GigaPath-Flash 和 GigaTIME-Flash 在保持强大性能的同时,降低了计算需求,为更大规模的研究和更广泛的探索打开了大门。文章《GigaPath-Flash 与 GigaTIME-Flash:迈向基于高效病理学基础模型的人群规模发现》……
GPT‑6 正在 ChatGPT 中面向全球推出,并配备 Intelligent UI,提供更快的响应,以及可探索、可直接使用的可视化与交互体验。
官方来源未提供摘要,点开可查看原文。
借助 GPT-5.6、GPT-6 Astra 和 GPT‑Image‑2.5,Pollo AI 帮助创作者将大胆创意转化为精细图像和电影级视频广告。
这是我们评估用于真实世界秘密扫描的LLM时学到的经验。文章《如何在上线前评估LLM》首发于GitHub博客。
GPT-6 Astra 提升了 Devin 测试软件并证明其正常工作的能力,目标是帮助工程师减少代码审查量并交付更多成果。
现在您可以通过Gemini 3.5 Transcribe获得更智能的语音转文字转录功能。
今天,我们在最新模型——Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite——中推出代理式视频理解能力。这项新功能在提高准确性的同时,大幅减少视频分析所需的 token 使用量和成本。与结合 Gemini 模型原生图像理解能力的类似代理式视觉功能相呼应……
认识GPT-6 Astra,OpenAI最强大的商业模型,具备高级推理、计算机使用能力,以及更强的写作和设计判断力。
使用GPT-6 Astra,Playco从一个灰色盒子的基础构建了三个主题游戏原型,并报告手动修复比之前的模型减少了50%。
GPT-Live-1 将自然的全双工语音对话引入 API,具备更强的指令遵循能力、自定义语音和电话支持。
GPT-6 Astra 帮助 Hex 的数据 agent 将答案转化为员工乐于分享的交互式可视化。
LLM并不会仅仅因为记住更多而变得更聪明。EvoLib将经验转化为持续演化的知识,提取可复用的技能和洞察,帮助模型在部署后长期跨任务学习和适应。文章“EvoLib:将经验转化为持续演化的知识”首次出现在微软研究院。
Legora使用GPT-6 Astra在几分钟内审查了41份文件,找到了所有四个预置错误,并在该财务审查工作流中将性能提升了近40%。
在三个月前 3.7 Flash 成功的基础上,并在短短六周内推出我们的第三个 Flash 版本,今天我们推出 Gemini 3.8——这是我们迄今最好的推理和编码模型,同时保持了 3.7 的速度和低成本。Gemini 3.8 提供两个变体:
了解 MIT 研究人员如何使用 GPT-5.6 Sol 和 Codex 自主运行量子计算实验、分析结果并校准量子比特。
GPT-6 Astra是我们能力最强、部署最广泛的模型,也是我们在预备框架下首个达到网络安全能力关键水平的模型。
Polimill使用OpenAI GPT模型和Codex帮助市政部门搜索和利用行政知识,同时加速开发。
Perplexity 使用 Astra 撰写沟通内容、修改软件并监控生产系统,与早期模型相比,检查频率大幅降低。
V7 使用 GPT-5.6 将分散的公司文件转化为可供上下文智能体使用的资料,以完成复杂且带来源链接的工作。
Aurora 1.5为Aurora基础模型增加了22个变量、小时级时间分辨率和概率集合预报,使其对实际天气、气候和能源应用更有用。文章“Aurora 1.5:扩展开放基础模型,用于天气和地球系统应用”首次出现在微软研究院。
推出面向金融服务的 ChatGPT,结合内置金融数据与 GPT-6 Astra,用于研究、建模和客户可用材料。
推出GPT-6 Astra,这是我们迄今为止最智能、最对齐的模型,在计算机使用、编程、网络安全和科学领域具备最先进的能力。
今天,我们推出 Gemini Omni 1.1 Flash,这是一套全新的创意控制和生成式视频功能,旨在为开发者提供支持。Gemini Omni 将现实世界推理引入生成式创作,而今天的更新使 Omni 1.1 通过 Google AI Studio 中的 Gemini API 为专业用途做好了生产准备。无……
Replit 推出由 GPT-5.6 Luna 驱动的免费模式,让任何人都能将想法转化为可运行的软件,而无需担心 token 成本。
今天,我们在广泛使用的Flash系列进展的基础上,推出Gemini 3.7 Flash,这是我们针对编码和智能体的最智能的主力模型。
Google Gemini和Pixel与五家全球足球俱乐部合作,通过AI和智能手机技术提升球迷的赛日体验。
随机对照试验的结果显示了Gemini的引导学习功能在提升参与度和加速学习方面的潜力。
Google和AIM推出了ATL Saathi,一个由Gemini驱动的AI工具,为印度机器人实验室的教育工作者提供支持。
我们宣布Gemini API中托管代理的新功能,使开发者能够构建可靠的生产级代理。
Gemini Omni和Google Vids中的个人头像使视频创作比以往更简单。
我们推出新的Gemini模型,包括Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber。
预览Ultrafast,这是一个新的OpenAI API服务层级,运行GPT-5.6 Sol的速度最高提升14倍。由Cerebras提供支持,每秒可输出高达750个token。
了解初创公司如何使用GPT-5.6,通过更智能的模型选择和新的Responses API功能,构建更快、更经济高效的AI代理。
Gemini 3.5 Live Translate为Google AI Studio、Google Translate和Google Meet带来近乎实时的自然语音翻译。
Gemini Robotics ER 2帮助机器人进行推理、协作和解决现实任务。它代表了视频理解、工具编排和多机器人协作在机器人应用中的重大进步。
Google推出Gemini 3.5 Flash Cyber,一款轻量级网络安全模型,用于发现和修补漏洞。
官方来源未提供摘要,点开可查看原文。
计算机使用现在作为内置工具集成在Gemini 3.5 Flash中,为智能体计算机使用任务提供了我们最好的性能。此前仅作为独立的Gemini 2.5计算机使用模型提供,现在计算机使用已原生集成到主要的Gemini Flash模型中。Gemini已经在函数调用方面表现出色…
我们宣布Gemini API中的托管代理新增更多功能,以便开发者构建可靠、生产就绪的代理。
认识 GPT-5.6-Cyber,OpenAI 的网络安全专用模型,可通过 Daybreak Red 用于授权的漏洞研究、漏洞验证和安全测试。
Model ML 使用 GPT-5.6 Sol 处理金融工作,从研究和分析到可编辑、可追溯的 PowerPoint 演示文稿和 Excel 工作簿。
一系列科学工具和实验,旨在扩大科学探索的规模和精度。
去年,Nano Banana将Gemini的智能带到了图像生成和编辑中。自那时起,它已帮助数百万人修复旧照片、从草图设计以及以以前不可能的方式可视化想法。我们从一开始就将Gemini构建为原生多模态的,现在我们…
今天,我们通过两个重大发布,让您更快速、更轻松地实验、完善和扩展您的创意:
今天,我们推出Gemma 4 12B,这是我们最新的模型,旨在将智能体多模态智能直接带到笔记本电脑上。Gemma 4 12B在边缘友好的E4B和更先进的26B专家混合(MoE)之间架起桥梁,将强大的功能封装在更小的内存占用中。它也是我们…
GPT‑5.6 现已在 Kiro 中可用,帮助开发者以更优的性价比进行软件规划、构建、审查和测试。
今天,我们推出DiffusionGemma,这是一个实验性的开放模型,探索文本扩散——一种极快的文本生成方法。该模型以Apache 2.0许可证发布,是一个26B的专家混合(MoE)模型,超越了典型自回归大型语言模型逐词顺序处理的方式…
在你的笔记本电脑上运行 AI 模型已变得容易得多,llama.cpp 在其中发挥了重要作用。其推理引擎为 Ollama、LM Studio 和 Jan 等本地 AI 工具提供支持。与 MLX 等项目一道,它帮助本地推理成为日常使用的切实可行之选。
阿拉伯语实际上是一个名字下的一整个语族。现代标准阿拉伯语是你在新闻或教科书里读到的那种,但人们日常交谈时很少这么说话。在阿联酋,日常对话、幽默、谈判和讲故事都用阿联酋阿拉伯语,这是一种海湾方言,有自己的词汇……
今天我们推出 BenchMIRT,一种在单个提示级别(即模型被评分的具体问题和任务)审计 LLM 基准测试的新方法。
我们的最新论文《LLM Compression by Block Removal with Constrained Binary Optimization》将这一对应关系落到实处。我们将模块选择重新表述为约束二元优化(CBO)问题,直接映射到Ising玻璃,一种具有全连接相互作用和固定数量的无序自旋系统……
TL;DR:Granite 4.2是我们第一个密集、仅解码器的推理LLM系列,提供三种规格:3B、8B和30B。每个模型从头开始预训练,使用约15万亿个令牌,采用五阶段策略,将上下文窗口扩展到512K令牌,并在思维链、推理和代理……上进行了监督微调。