内容
精选全部 AI 动态热点榜AI 日报主题收藏
模型
模型榜
更多
Agent 接入关于更新日志反馈
京ICP备2026012723号-2
精选全部日报更多
反馈

全部 AI 动态

全部动态模型 · 6 条
来源全部一手资讯X
类型模型
全部模型产品行业论文教程观点
标签「论文/研究」清除

6月18日周四

10:32公众号:通义实验室(千问)73精选统一科学大模型 LOGOS 正式开源

6月16日周二

07:19Rohan Paul58Pythagoras-Prover 发布 4B 参数定理证明器及扩散模型概念验证版

6月10日周三

02:08Hacker News 热门(buzzing.cc 中文翻译)84同事件系统卡:Claude Fable 5 和 Claude Mythos 5 【pdf】同一事件,精选展示《Claude Fable 5 和 Claude Mythos 5》

4月30日周四

23:10IT之家(RSS)72精选DeepSeek 公布多模态模型技术报告
08:00HuggingFace Daily Papers(社区热门论文)62MiniCPM-o 4.5:迈向实时全双工全模态交互

4月29日周三

02:11The Decoder:AI News(RSS)47一个对1930年后世界一无所知的LLM如何想象2026年
共 6 条,没有更多了
全部 AI 动态
2026年8月25日星期二 · AI 相关资讯全量信息流
全部模型产品行业论文教程观点
模型 · 标签「论文/研究」 · 6 条清除

6月18日

星期四 · 1 条
10:32
公众号:通义实验室(千问)精选
AI 评分 73/100
统一科学大模型 LOGOS 正式开源

LOGOS 是由 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源的基于统一“科学语法”的多领域科学生成基础模型。LOGOS-1B 仅用 1/56 参数量即在多个任务上超越 NatureLM,逆合成预测 Top-1 准确率达 74.8%。模型涵盖 7 类模态、44.87B tokens 预训练语料,无需 3D 坐标,已开源模型权重、推理代码与技术报告。

开源生态模型发布论文/研究

推荐理由:以统一序列语法将蛋白质、小分子、材料接入LLM框架,实验显示跨领域知识正向迁移,参数效率远超现有通用科学模型,开源后AI4S的开发流程可能被简化。

6月16日

星期二 · 1 条
07:19
Rohan Paul@rohanpaul_ai
AI 评分 58/100
Pythagoras-Prover 发布 4B 参数定理证明器及扩散模型概念验证版

Pythagoras-Prover 团队发布最小定理证明器 4B 版本及首个扩散模型概念验证版,均仅 4B 参数。在 MiniF2F 测试中,4B 模型以 86.1% Pass@32 超越 DeepSeek-Prover-V2-671B;32B 版本达 89.8% Pass@32 和 92.6% Pass@2024,创当前最佳成绩。核心在于数据效率:构造约 80 万 Lean 验证示例,按易到难训练,并采用 LoRA 微调避免全参数更新。模型上下文窗口为 8192 tokens。模型、数据及训练流水线将陆续开源。

Joshua Ong @ ICML: 🚀🚀 Introducing Pythagoras-Prover 🚀🚀 🔹 The smallest theorem prover to date – Pythagoras-Prover-4B 🔹 The first proof...

开源/仓库推理数据/训练模型发布

6月10日

星期三 · 1 条
02:08
Hacker News 热门(buzzing.cc 中文翻译)同事件
AI 评分 84/100
系统卡:Claude Fable 5 和 Claude Mythos 5 【pdf】

Anthropic 发布了 Claude Fable 5 和 Claude Mythos 5 的系统卡(System Card),以 PDF 格式公开,内容涵盖两个模型的架构、安全评估与部署限制。

Anthropic安全/对齐模型发布论文/研究
同一事件,精选展示《Claude Fable 5 和 Claude Mythos 5》

4月30日

星期四 · 2 条
23:10
IT之家(RSS)精选
AI 评分 72/100
DeepSeek 公布多模态模型技术报告

DeepSeek发布了多模态大模型及技术报告,提出创新的“基于视觉原语的思考”框架。该框架将点、边界框等视觉元素作为推理的基本单元,旨在解决多模态模型在空间参照任务中存在的“参照鸿沟”核心问题,使模型能将抽象认知锚定到图像的具体坐标上。尽管模型规模紧凑且图像标记预算较低,其在多项挑战性计数和空间推理基准测试上的性能,可与GPT-5.4等前沿模型相媲美。

DeepSeek多模态推理论文/研究

推荐理由:DeepSeek 把视觉概念直接变成推理单元,绕开了语言描述空间的先天模糊,在空间推理上把自家紧凑模型拉到和 GPT-5.4 一个水平,做多模态应用的人值得细读。
08:00
HuggingFace Daily Papers(社区热门论文)
AI 评分 62/100
MiniCPM-o 4.5:迈向实时全双工全模态交互

当前多模态大语言模型在交互范式上存在瓶颈,感知与响应分离且缺乏主动性。MiniCPM-o 4.5 通过 Omni-Flow 统一流式框架,将多模态输入输出对齐到共享时间轴,实现实时全双工全模态交互,支持同时感知与响应,并能基于对动态场景的连续理解主动发出提醒或评论。该模型参数量为 90 亿,在视觉语言能力上接近 Gemini 2.5 Flash,在全模态理解上超越 Qwen3-Omni-30B-A3B,且语音生成更优、计算效率显著更高。得益于高效的架构设计和推理优化,模型可在内存小于 12GB 的边缘设备上实现实时全双工全模态交互。

多模态模型发布端侧论文/研究

4月29日

星期三 · 1 条
02:11
The Decoder:AI News(RSS)
AI 评分 47/100
一个对1930年后世界一无所知的LLM如何想象2026年

名为“Talkie”的130亿参数语言模型仅使用1931年前的文本训练,其对未来世界的预测呈现出强烈的时代局限性。该模型怀疑第二次世界大战是否会发生,并将2026年想象成一个仍以蒸汽船、铁路和廉价小说为主导的世界。这直观揭示了训练数据的时间范围如何从根本上限制大语言模型对现实发展的认知与预测能力。

数据/训练现象/趋势论文/研究
共 6 条,没有更多了