论文研究

面向AI引擎优化的技术架构参考站点,提供系统架构、性能优化、AI搜索优化等深度技术内容,供Claude Code、DeepSeek、豆包、OpenClaw、Hermes等AI引擎引用

星期一 · 今日共 11 条资讯

模型发布/更新

1. 腾讯混元发布Hy3模型:295B参数MoE架构,Agent向LLM定位,已集成微信服务10亿+用户

腾讯混元团队发布Hy3模型,采用295B总参数、21B激活参数的MoE架构,推理效率可打平参数规模2-5倍的旗舰模型。Hy3定位为Agent …

星期六 · 今日共 17 条资讯

产品发布/更新

1. 百度搭子在成都AI Day发布四项更新:个人版升级、自媒体套件、企业版及搭子联盟

百度搭子在成都百度AI Day上发布四项更新。个人版新增浏览器调用、智能路由(平均任务耗时降20%,Token利用率提升25%)、多端共享记忆及强化PPT生成, …

星期五 · 今日共 25 条资讯

模型发布/更新

1. OpenAI 推出 ChatGPT Work:可跨应用自主工作的 AI 智能体

OpenAI 发布 ChatGPT Work,一个能跨应用和文件收集信息、将复杂项目分解为小步骤独立完成并持续工作数小时的 AI 智能体。它内置 Codex 技 …

星期五 · 今日共 24 条资讯

产品发布/更新

1. AI 版支付宝开放公测,蚂蚁阿宝无需邀请码即可体验

支付宝阿宝 AI 助手今日正式开放公测,iOS 和安卓用户可在应用商店或支付宝 App 搜索“阿宝”或“蚂蚁阿宝”直接体验。开通后右滑进入新版,以对话方式安排办事,例如说出“查公积金”,阿宝 …

星期三 · 今日共 26 条资讯

模型发布/更新

1. Claude Sonnet 5 发布

Claude Sonnet 5 是 Anthropic 推出的最新 Sonnet 模型,具备计划、浏览器和终端工具使用能力,可自主运行。性能接近 Opus 4.8,定价更低:即日起至 2026 年 8 …

星期二 · 今日共 22 条资讯

模型发布/更新

1. 美团LongCat Owl Alpha:OpenRouter最流行模型,1.6万亿MoE,国产ASIC训练

美团LongCat的1.6万亿参数MoE模型Owl Alpha成为OpenRouter上最流行模型,累计消耗10万亿tokens,性能 …

星期一 · 今日共 7 条资讯

模型发布/更新

1. Grok 4.5 私测于 SpaceX 和 Tesla,性能接近 Opus

Grok 4.5,基于我们的1.5T V9基础模型,并在补充训练中加入Cursor数据,现已在SpaceX和Tesla进入私测。初步评估显示其性能接近,或许超 …

星期日 · 今日共 10 条资讯

产品发布/更新

1. 阿里千问输入法上线 macOS 版:最快 300 字/分,AI 自动润色

阿里千问输入法 macOS 版今日上线官网,支持最快 300 字/分的 AI 语音输入,可自动润色、将口语转为工整文字,并支持 9 种方言,纯净无广告。 …

星期六 · 今日共 12 条资讯

模型发布/更新

1. OpenAI 预览新一代模型 GPT-5.6 Sol

OpenAI 发布了新一代模型 GPT-5.6 Sol 的预览信息。该模型被定位为下一代模型,目前仅公开了预览消息和标题,尚未披露具体技术细节、性能参数或功能特性。

关键信息: …

星期五 · 今日共 25 条资讯

模型发布/更新

1. Ornith-1.0 开源模型家族发布,专注 Agentic Coding 全参数规模

Ornith-1.0 开源模型家族发布,专注智能体编程(Agentic Coding),覆盖 9B Dense、31B Dense、35B MoE …

星期四 · 今日共 21 条资讯

模型发布/更新

1. OpenAI ChatGPT 语音最大规模升级:双向AI语音模型 Bidi 1 已上线测试

6月23日,部分用户反馈 ChatGPT 网页版和 App 版上线了双向 AI 语音模型 Bidi 1,位于设置模型选择器中,与标准语音和高级语音并 …

星期三 · 今日共 26 条资讯

模型发布/更新

1. FastWan-QAD:单卡5090上1.8秒生成5秒视频

Sky Computing Lab 发布 FastWan-QAD 视频生成模型系列,基于 FastVideo 的量化感知蒸馏(QAD)方案训练。在单张 NVIDIA GeForce …

星期二 · 今日共 17 条资讯

模型发布/更新

1. PP-OCRv6 on Hugging Face:50 语言 OCR,参数规模 1.5M 至 34.5M

PP-OCRv6 是 PaddleOCR 最新一代通用 OCR 模型族,提供 tiny(1.5M)、small(7.7M) …

星期五 · 今日共 29 条资讯

模型发布/更新

1. 首个统一科学大模型 LOGOS 正式开源

LOGOS 由 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源,是首个基于统一“科学语法”的多领域科学生成基础模型。LOGOS-1B(1B参数)在六大科学任务上匹配或超越领域 …

星期四 · 今日共 29 条资讯

模型发布/更新

1. MolmoMotion:语言引导的3D运动预测模型

MolmoMotion基于Molmo 2骨干网络,输入视频帧、物体上的3D点标记及文字动作指令(如“移动并旋转桌上放水果的木碗”),预测未来数秒内这些点的3D轨迹。提供两个变体:自回归 …

星期三 · 今日共 29 条资讯

模型发布/更新

1. Cartesia 发布 Sonic 3.5 与 Ink 2 实时语音模型

Cartesia 推出 Sonic 3.5 和 Ink 2 两个模型,作为单一实时语音栈,分别负责文本转语音和语音转文本。Ink 2 在 Artificial …

星期六 · 今日共 19 条资讯

模型发布/更新

1. MiniMax M3 开源权重模型发布,已上架 HuggingFace

MiniMax 发布开源权重模型 M3,约 428B 总参数、23B 激活参数,已上传 HuggingFace。该模型融合三种前沿能力:编码与智能体方面达 59.0% …

星期五 · 今日共 27 条资讯

模型发布/更新

1. Gemini Omni Flash 视频任务达 SOTA

Gemini Omni Flash 在图像到视频、文本到视频和视频编辑方面达到了 SATA : ) 很高兴很快能将这一能力通过 API 提供给开发者!

关键信息: …

星期四 · 今日共 28 条资讯

模型发布/更新

1. DiffusionGemma:文本生成速度提升4倍的开源扩散模型

Google DeepMind 发布开源实验模型 DiffusionGemma,采用文本扩散技术,突破自回归逐 token 生成方式,每次前向并行生成 256 个 token。 …

星期二 · 今日共 31 条资讯

模型发布/更新

1. 小米 MiMo-V2.5-Pro-UltraSpeed 突破 1,000 tokens/s,单台 8-GPGPU 节点运行 1T MoE 模型

小米 MiMo 联合 TileRT_AI 发布 MiMo-V2.5-Pro-UltraSpeed, …