商汤发布并开源 SenseNova-Vision 理解生成统一视觉大模型,能力超越 Vision Banana SenseNova-Vision 的核心变革是:让视觉成为通用基础模型的原生能力,彻底融入大模型体系。所有经典视觉任务如目标检测、图像分割、深度预测、3D 重建等,由此都实现了原生统一。 AI 新资讯行业资讯# SenseNovaVision# 商汤# 开源 2个月前4,028622
腾讯发布并开源混元 Hy3 模型,宣称效果比肩国内外更大尺寸旗舰模型 腾讯混元官方宣布,继 4 月底发布 Hy3 preview 后,通过反馈修复了各种体验问题,进一步提升了后训练的质量和规模。 AI 新资讯行业资讯# 开源# 混元 Hy3# 腾讯 3个月前2,738852
百度开源 Unlimited OCR 模型:基于 DeepSeek OCR,解析文档告别 AI 越生成越慢 百度于 6 月 22 日开源推出 Unlimited OCR 模型,总参数量 30 亿,推理时仅激活 5 亿参数,目标解决在解析长文档时,端到端 OCR 模型越生成越慢的问题。 AI 新资讯行业资讯# ai# deepseek# OCR 3个月前4,015819
让大模型从“一问一答”走向“边看边说”,京东开源实时视频视觉语言交互模型 JoyAI-VL-Interaction JoyAI-VL-Interaction 支持摄像头、直播流、监控流等多种视频输入,也支持语音输入输出、可视化界面、长期记忆、后台模型接口和 vLLM 部署方案。 AI 新资讯行业资讯# 京东# 大模型# 开源 3个月前5,894726
大晓机器人开源 ACE-Ego 具身操作 VLA 模型,能稳定完成塑料袋打包、鞋子装入鞋盒等操作 大晓机器人今日宣布,联合香港中文大学多媒体实验室正式发布全新“一脑多型”具身操作 VLA 模型 ACE-Ego,并向行业开源。 AI 新资讯行业资讯# 具身智能# 大晓机器人# 开源 3个月前3,988710
月之暗面开源 Kimi K2.7 Code 编程模型,预告 6 倍速高速版周一见 月之暗面 Kimi 今日发布并开源 Kimi K2.7 Code 编程模型。 AI 新资讯行业资讯# Kimi K2.7 Code# 开源# 月之暗面 3个月前4,090193
商汤开源 SenseNova U1 图文交错生成增强版模型:支持多页连续创作,角色风格不“跑偏” 该模型面向图文交错创作与生成(Interleaved Generation)场景进行了专项强化,更好地支持绘本、故事书、多页 PPT、图文教程等连续内容创作。 AI 新资讯行业资讯# SenseNova U1# 商汤# 开源 3个月前3,269601
摩尔线程开源 MusaCoder:首个基于国产全功能 GPU 全栈训练的代码大模型 这是业内首个基于国产 GPU 算力底座完成全链路训练与验证的开源代码大模型,其完整后训练流程均在基于 MTT S5000 构建的夸娥智算集群上完成。 AI 新资讯行业资讯# MusaCoder# 国产 GPU# 大模型 3个月前5,18813
阶跃星辰开源 Step 3.7 Flash 模型,最高生成速度每秒 400 Tokens Step 3.7 Flash 采用稀疏 MoE 架构,总参数 196B+1.8B(ViT)、激活参数 11B。 AI 新资讯行业资讯# 大模型# 开源# 阶跃星辰 4个月前5,49926
AI 制造 AI:面壁智能开源全球首个完全由 AI 编写的生产级训练框架 ForgeTrain 面壁智能今日联合清华大学、OpenBMB 开源社区正式发布 ForgeTrain—— 全球首个完全由 AI 编写、零人类代码介入的生产级大模型训练框架。 AI 新资讯行业资讯# ai# ForgeTrain# 开源 4个月前6,34375