🔥 HN 热议

Qwen3.8-27B发布:能看图和视频的可下载AI,改变了什么?

约2分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Qwen3.8-27B

Qwen发布的、可处理文字、图片和视频的AI模型。

词元

AI处理文字等信息时使用的小单位。

模型说明

发布方介绍AI功能、用法和测试结果的资料。

发生了什么

Qwen发布了Qwen3.8-27B。它的模型文件和设置文件已经公开,使用兼容软件的人可以在自己的计算环境中运行它。Qwen的模型说明把它列为视觉语言模型:它能处理文字、图片和视频。

名称中的27B,指模型约有270亿个内部调节值。这个数字不等于人人都能轻松运行。较大的模型可能需要较多存储空间、内存和计算能力。

它要做什么

Qwen称,这个模型面向编程、专业工作、研究和多步骤任务。它支持先进行较多思考再回答,也允许使用者选择思考深度,或直接要求回答。

说明还提醒,少想一点不一定让整个任务更快。若答案因此出错,反复重做可能花更多时间和资源。

为什么重要

这不是只处理文字的聊天工具。它试图把看图、看视频、写代码和完成多步工作放到同一个模型中。Qwen也提供了多种运行工具的使用说明。因此,开发者和组织不只能够通过一家公司的网页服务使用它,也可以在合适的自有环境里测试和部署。

不过,文件公开不等于使用没有门槛。运行模型仍涉及硬件、软件配置和实际测试。

已经确认的事

模型说明显示,Qwen3.8-27B使用Apache 2.0许可,并提供Transformers、vLLM和SGLang等工具的运行指引。Qwen称其原生上下文长度为262,144个词元,最多可扩展到100万个词元。上下文长度是AI在一项任务中可参考的信息量,不保证它会正确理解。

Qwen的比较表报告,它在多项编程和视觉测试中高于前代Qwen3.6-27B。这些是发布方报告的结果;其中有内部测试,而且不同测试的条件并不相同。

介绍该模型的Hacker News投稿获得751 points和489 comments。这说明该社区很关注此事,不是对性能说法的独立证明。

还不知道什么

只看模型说明,不能确定它在真实工作中的可靠程度,也不能确定不同用户需要多少硬件。它处理长视频和复杂任务时的速度、成本和出错方式,也需要独立测试。

接下来该看什么

值得关注的是第三方评测、部署所需资源,以及真实工作流程中的表现。能一次读进很长的资料或视频,不等于一定能正确理解其中内容。

💬 Qwen 3.8 27B:本地运行的期待与评测的谨慎

评论者看好一款27B模型能在较易获得的硬件上运行,但也在争论:基准测试排名能否说明它在广泛真实工作中更强。

  • 用户把它视为显著进步,并期待能在笔记本或消费级硬件上运行。不过,实际速度和易用性仍取决于具体配置。
  • 有帖子给出DeepSWE成绩42.2对40,称其超过Opus 4.7 Max。这是评论者提供的一项基准比较,不能直接证明它在所有真实工作中更强。
  • 反对意见认为,不能过早把27B模型当作通用实战能力等同于前沿API模型;但也承认,本地模型对许多任务可能已经足够,而且硬件成本有吸引力。
  • 另一位用户自行报告:在250个嵌入式系统任务的内部评测中,Qwen 3.6 27B的pass@1比Opus-4.8低4%。这针对的是旧模型和特定工作流,不是Qwen 3.8的通用结论。
  • 评论建议按运行环境选择发布格式:GGUF适合llama.cpp和更广泛的设备;官方FP8权重适合在性能足够的GPU上通过vLLM运行。
  • 针对高并发数据整理,一位用户自行报告Blackwell上的NVFP4约比FP8快1.2至1.5倍。讨论没有得出这种取舍是否会降低输出质量的结论。
  • 量化版本如何评估仍有争议:批评者认为只看KL散度不足以说明代理或编程能力。提供方回应称,完整评测慢且贵时,它可作较便宜的代理信号,并自行报告95%以上相关性及另行发布MMLU Pro等评测。

这是评论数为772时的成熟版(修订4)。获取500条,并从整体抽取120条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

Qwen的新AI能读文字,也能看图片和视频

📰 完整报道: Qwen3.8-27B发布:能看图和视频的可下载AI,改变了什么?

Qwen发布了Qwen3.8-27B。它可以在合适的电脑上运行,但需要做好准备。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Qwen

发布这个AI模型的团队。

Qwen3.8-27B

能处理文字、图片和视频的新AI。

💡 一句话总结

  • Qwen发布了新的AI模型。
  • 它能处理文字、图片和视频。
  • HN上的热度不等于性能已被证明。

Qwen是制作AI模型的团队。 它的新模型叫Qwen3.8-27B。

它可以读文字并回答问题。 它也能看图片和视频。 Qwen公开了文件和使用说明。 有合适电脑的人可以试着运行它。

27B表示约270亿个内部调节值。 这些调节值帮助AI工作。 模型大,不一定就更好用。 它也可能需要更多内存和存储空间。

Qwen说,这个AI能帮助写程序和完成多步工作。 它可以先多想一会儿再回答。 使用者也能让它直接回答。

看起来快,不一定真的省时间。 如果想得太少而答错,就要重做。 重做会花掉更多时间。

Qwen报告说,新模型在一些测试中比旧模型分数高。 这些结果可以参考。 但不能只靠这些数字下结论。 部分测试来自Qwen自己。 不同测试也有不同规则。

Hacker News上的介绍得到751 points和489 comments。 这表示许多人注意到它。 这不表示它的每个答案都正确。

下一步要看独立测试。 也要看它在真实工作里是否稳定。 不同电脑需要多少资源,也很重要。

💬 能在个人设备上运行的AI,但胜负未定

大家期待Qwen 3.8 27B能在个人机器上发挥作用,也提醒大家:测试分数不等于日常工作的表现。

  • 评论者喜欢27B模型可能可用于笔记本和消费级GPU。它有多快,还是要看机器和软件。
  • 有帖子说它在一项编程测试中胜过大型API模型;也有人说,这不能证明它每种真实任务都更好。
  • 一家公司的自行报告显示,在250个嵌入式开发任务上,旧版Qwen 3.6 27B比Opus低4%。讨论因此建议用自己的工作来测试模型。
  • 文件格式也重要:GGUF更容易用llama.cpp在多种设备上运行,FP8则面向更强的GPU和vLLM。
  • 人们也在争论怎样评价被压缩的量化模型。KL散度可作快速检查,但批评者认为仍需要实际任务测试。

这是评论数为772时的成熟版(修订4)。获取500条,并从整体抽取120条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

Qwen会看图啦

📰 完整报道: Qwen3.8-27B发布:能看图和视频的可下载AI,改变了什么?

Qwen做了一个新的电脑小帮手。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Qwen

做电脑小帮手的团队。

Qwen3.8-27B

Qwen新电脑小帮手的名字。

Qwen是做AI的团队。 新帮手叫Qwen3.8-27B。

它会读文字。 它会看图片。 它也会看视频。

有些人能在自己的电脑上用它。 可是,它可能需要很大的电脑。

它可以想一想再回答。 它也能快一点回答。

Qwen说,它比以前更厉害。 别的人也要来试一试。

很多人在Hacker News谈它。 大家喜欢看,不等于它总是对的。

以后会有更多人来检查它。

💬 可以在家运行的AI

大家在聊一个可能能跑在自己电脑上的新AI。

  • 很多人高兴,因为它可能不用超级大电脑也能很厉害。但每台电脑跑得不一样快。
  • 有一个测试说它表现很好。也有人说,一个测试不能说明它做所有工作都最好。
  • 把AI装进电脑有不同方法。该选哪一种,要看你的电脑和你要做的事。

这是评论数为772时的成熟版(修订4)。获取500条,并从整体抽取120条总结。内容属于HN用户自述,并非编辑部核实的事实。

来源