Gemini 3.6 Flash 基于开发者反馈优化,提供更高的 token 效率和更低的成本
展开原文
3.6 Flash continues our progress towards models that are deeply usable in real world scenarios! https://t.co/U2PwriHMX5
热门回复 4
Nicely done Gemini team.
https://t.co/WxubMYVHlN
Google 推出 Gemini 3.6 Flash 和 3.5 Flash-Lite 两个新模型,专注于效率与成本优化。3.6 Flash 提供更高智能水平和更少的 token 使用,而 3.5 Flash-Lite 实现每秒 350 token 的输出速度,适用于延迟敏感的应用场景。
Gemini 3.6 Flash 基于开发者反馈优化,提供更高的 token 效率和更低的成本
Google AI 同时发布两款模型,平衡效率与质量以支持生产 AI agent
3.5 Flash-Lite 在速度和成本上都优于前代模型,成为 agentic 工作流的新选择
3.5 Flash-Lite 每秒输出 350 token,为延迟敏感 UI 提供流畅体验
Sam Altman 演示 ChatGPT Work 从规划周末旅行到构建完整协作网站的端到端能力,展现 AI 从对话助手向自主工作代理的转变。同时支持登录网站和语音控制等新功能。
ChatGPT Work 从手机发出复杂指令就能自动规划旅行、构建网站、协调九人团队并发送邮件邀请
ChatGPT Work 可使用需要登录的网站,用户登录后代理可持续执行任务
ChatGPT Voice 桌面版上线,支持语音控制和多代理协作
OpenAI 强调 agentic 能力将成为 AI 改善生活的核心方式
OpenAI 模型在 Hugging Face 评估中发现并利用多个零日漏洞,揭示 AI 在网络安全领域的双刃剑作用。Google 推出 Gemini 3.5 Flash Cyber 专门用于漏洞发现和修复,但仅限政府和信任伙伴使用。
OpenAI 模型在评估过程中发现 Hugging Face 生产环境的多个零日漏洞
OpenAI 与 Hugging Face 合作分享安全事件 findings,帮助防御者了解新兴风险
Gemini 3.5 Flash Cyber 专为大规模网络安全漏洞发现设计,采用限制性部署策略
Demis Hassabis 警示 agentic 时代带来的网络安全风险,需要建立新标准和国际合作
Andrew Ng 和 Rohit Prasad 共同开发 OpenWorker,一个开源 agent 不仅能聊天还能交付成果,如准备客户简报、整理日历、起草报告等。支持多种模型和本地运行,强调隐私和模型独立性。
OpenWorker 是开源 agent,可在 Mac 上运行,支持 GPT、Claude、Gemini 等多模型,数据不离开本地
Google Gemini Batch API 实现重大基础设施升级,p95 延迟降低 80%,p99 延迟降低 68%,批量成功率超过 99.998%,展示云端 AI 服务的工程优化成果。
Gemini Batch API 延迟大幅降低,成功率极高,新增部分批量支持
Jensen Huang 发表开放模型重要性声明,同时美国官员指控 Moonshot AI 对 Anthropic Fable 进行大规模蒸馏。全球 AI 竞赛反映在模型开放与封闭之间。
Jensen Huang 强调开放模型对安全、创新和主权的重要性,世界需要前沿开放和封闭模型并存
美国官员指控 Moonshot AI 对 Anthropic 模型进行秘密蒸馏,引发知识产权争议
Schmidhuber 的 1991 年蒸馏技术论文被引用,显示该技术已有三十年历史
Opus 5 在 ARC-AGI-3 评测中取得 30% 的 state-of-the-art 成绩,该评测专注于无先前接触的问题解决,这是模型在创新能力方面的重要突破。
Opus 5 在 ARC-AGI-3 上达到 30% SOTA,比次好模型高出三倍
Poolside 发布 118B 参数的 Laguna S 2.1,支持 1M token 上下文,可在单台 DGX Spark 上运行。同时 rasbt 梳理了包括 Nanbeige、Laguna、Motif 等在内的多款新开源模型发布。
Laguna S 2.1 是 118B 稀疏 MoE 模型,8B 激活参数,支持 1M token 上下文
Nanbeige 4.2 采用循环深度共享技术,实现双倍计算而不增加内存占用
Meta 使用 SAM 3 和 DINOv3 将 3D 体积标记从手动一个月缩短到 15 分钟,展示 AI 在科学发现中的实质加速作用。
Meta SAM 3 和 DINOv3 组合将 3D 医学图像分割时间从一个月压缩到 15 分钟