2025年10月5日
这几天 AI 圈都在被 Sora 2 刷屏,没想到国产 AI 也悄咪咪地干了票大的。 腾讯的混元图像大模型 3.0,才发布一周,就在全球最硬核的 AI 竞技场 LMArena 上杀疯了——在26 个全球顶级模型混战,拿下文生图全球榜单的 Top 1! 这可不是什么野榜,LMArena 是加州大学伯克利分校搞的,纯靠全球网友「盲测」投票,谁好谁……
阅读全文
2025年10月5日
最近腾讯开源了一个新模型——混元图像 3.0。 它的宣传点很直白:不仅能画图,还能准确「理解」,和利用世界知识「推理」。比如我们想做一张广告海报,它能把商品画出来,还顺手把文字排版好;想做一套漫画,输入一句话,它就能帮我们画好分镜。 听起来是很强,但也让人好奇,它真能替代设计师吗?还是……
阅读全文
2025年10月5日
上周刚刚写过一篇腾讯混元的分析贴-我还在说腾讯最近在腹泻式开源, 然后,文章刚发,就又开源了HunyuanImage-3.0模型,不少网友说是开源界的nano banana, 今天刷X,发现它在LMArena(就是那个盲测对战投票榜单)上竟然拿下了第一(见图2-3), 超过了Google……
阅读全文
2025年10月5日
宝子们!刚刚腾讯发布了混元图片3.0模型! 关键是完全开源!!免费用!! 传送门:https://hunyuan.tencent.com/ 用户界面看起来非常简洁。 下面测评下,看看生成效果到底如何?先从3D类开始。 一、3D渲染类 这是一幅 3D 卡通风格的图像,画面中心是一个穿着校服、背着书包……
阅读全文
2025年10月5日
这意味着模型自身就具备了世界知识和推理能力,感觉特别适合绘制一些小科普的插图(当然还是需要专家校对) ▶ 混元官网:https://hunyuan.tencent.com/image ▶ Huggin Face:https://huggingface.co/tencent/HunyuanImage-……
阅读全文
2025年10月5日
AI 一键出日报 现在做自媒体,谁不是几十上百个群?信息爆炸、重要消息老是错过。 我的做法是:让 AI 自动把群聊变成可视化日报——热点话题、重要通知、工具推荐、问答沉淀,一页看完,特别清爽。 思路一句话:用 Chatlog 把微信聊天记录“接出来”,再用支持 MCP 的 AI(如 Cursor / Cherry Studio)自动总结,并生成一份……
阅读全文
2025年10月5日
昨天,Osmosis AI 发布了一项特别的内容:一个拥有 6 亿参数的模型,它解决了生产 AI 中最令人沮丧的问题之一——结构化输出会削弱你的智能模型。 如果你曾经尝试过强制 GPT-4 或 Claude 输出 JSON,你就知道有多痛苦。你的准确率会大幅下降。当你强制 GPT-4.1 输出结构化输出时,它在 AIME 数学问题上的准确率仅为 2.7……
阅读全文
2025年10月5日
大多数团队将 LLM 调用视为要么是同步的 (现在给我答案)要么是批量的 (今晚运行整个数据集)。然而,对于某些工作负载来说,批量推理并不适用,这就是我们为什么要引入一种新的 LLM 请求类型:一个_异步的_请求。 异步请求 – 一旦空闲 GPU 可用,就会完成。 以下是关于为什么这很重要以及如何今天使用 Inference.net 来实现它……
阅读全文
2025年10月5日
引言 模型蒸馏,也称为知识蒸馏,是一种机器学习技术,它将知识从一个大型的复杂模型(“教师”模型)转移到一个小型、更高效的模型(“学生”模型)。它已成为优化 AI 模型的关键技术,尤其是在计算资源、速度或成本成为限制因素时。大型模型,如大型语言模型(LLMs)或视觉语言模型(VLMs),在……
阅读全文
2025年10月5日
并非每个 LLM 请求都需要立即响应。聊天界面需要实时响应。但数据提取、丰富化和后台工作可以等待数小时。这种时间灵活性可以解锁巨大的成本节省,尽管简单的实现会创造可靠性噩梦。 这种模式非常常见。一个团队需要处理数十万份文档,所以他们编写了一个循环,等待每个响应。然后脚本在请求 1000 次时失败,他……
阅读全文