Chinanews
Tech少数派-数字生活Fri, 28 Aug 2026 08:29:37 +0800

Paizao: Zhipu open-sources GLM-5.3-Flash native multimodal model, entre outros

人工智能大模型智谱多模态

No dia 26 de agosto, a Zhipu (Z.ai) lançou e abriu o código do GLM-5.3-Flash (320B-A18B), o primeiro modelo nativo multimodal da série GLM-5.

O modelo adota uma arquitetura MoE (Mistura de Especialistas), com um total de 320 bilhões de parâmetros, ativando cerca de 18 bilhões de parâmetros por Token. Suporta entrada de texto e imagem, além de um contexto de 1 milhão de Tokens, e disponibiliza os pesos do modelo sob a licença MIT. Na avaliação Artificial Analysis Intelligence Index v4.

1.1, o GLM-5.3-Flash obteve 57 pontos, empatando com o Claude Opus 4.

8 Max Effort. O teste Z.ai Code Bench v1.

0, desenvolvido pela própria Zhipu, mostra que o modelo atingiu 29,0 pontos no nível máximo de inferência, enquanto o Claude Opus 4.8 marcou 29,5. Em termos de arquitetura, o GLM-5.

3-Flash combina atenção esparsa e atenção linear, e introduz Manifold-Constrained Hyper-Connections (mHC) para reduzir o custo computacional da inferência de contexto longo e o uso de KV Cache. O modelo também integra capacidades visuais nos fluxos de trabalho de Coding e Agent, podendo combinar Browser Use e Computer Use para processar páginas da web, interfaces de usuário e feedback de execução de código. Além do desenvolvimento de software, o GLM-5.

3-Flash suporta cenários como escritório, pesquisa financeira e processamento de documentos profissionais, podendo combinar ferramentas externas para concluir análises, modelagens e gerar arquivos em formatos como PPTX, PDF, DOCX e XLSX. Atualmente, o modelo já está integrado ao ZCode, GLM Coding Plan e à API oficial, e os pesos do modelo foram disponibilizados no Hugging Face. Em relação aos preços, a Zhipu informou que o preço padrão da API do GLM-5.

3-Flash é cerca de um décimo do GLM-5.3, e durante o desconto promocional, cerca de um vigésimo. Fonte: Perplexity AI lança o Portable Computer No dia 25 de agosto, a Perplexity, em parceria com a NVIDIA, lançou o Portable Computer, um agente de IA no dispositivo.

O produto suporta a execução completa do fluxo de trabalho principal do Perplexity Computer no próprio dispositivo, realizando processamento puramente local para análise de arquivos, recuperação local e agendamento de tarefas, acionando modelos na nuvem apenas mediante autorização do usuário e conforme necessário. Em termos de adaptação de hardware e modelo, o Portable Computer é lançado com suporte inicial para o NVIDIA DGX Spark executando o sistema Linux, podendo rodar diretamente o Qwen 3.8 27B e o modelo PPLX 27B pós-treinado pela própria Perplexity, sem que as tarefas concluídas localmente consumam Perplexity Credits.

No futuro, também serão introduzidos gradualmente o NVIDIA Nemotron 3.5 Lightning e sua versão ajustada otimizada para respostas rápidas. Atualmente, o Portable Computer está disponível para usuários do Perplexity Pro e Max; o suporte para sistemas Windows e PCs equipados com GPUs GeForce RTX / RTX PRO será lançado posteriormente.

Fonte: BenQ lança a série de monitores profissionais Creative Pro PV50 No dia 25 de agosto, a BenQ lançou a série de monitores profissionais Creative Pro PV50, incluindo os modelos de 32 polegadas PV3250U e 27 polegadas PV2750U. Ambos os monitores possuem resolução 4K UHD e são voltados para edição de vídeo e colorização de pós-produção. Em relação às cores, a série PV50 é calibrada para fluxos de trabalho Rec.

709 e Gamma 2.4, e suporta a função Dark-Tone Clarity (Clareza de Tons Escuros) para melhorar a representação de detalhes nas sombras, reduzindo a compressão de níveis de preto e desvios de tonalidade. A série também suporta uniformidade de cor e brilho em toda a tela, bem como calibração de hardware 3D LUT de 16 bits, com dados de calibração armazenados internamente no monitor.

Quanto às funções de fluxo de trabalho, os monitores oferecem ferramentas como Shadow Check (Verificação de Sombras), Marker (Marcador de Enquadramento) e Area Zoom (Ampliação Local), e vêm equipados com viseira magnética e controlador Hotkey Puck. Nas conexões, a série PV50 suporta Thunderbolt 4, permitindo a transmissão de vídeo e dados através de um único cabo, e fornecendo energia reversa de até 96W. Fonte: Google lança o modelo de conversão de voz para texto Gemini 3.

5 Transcribe No dia 26 de agosto, o Google lançou o modelo de reconhecimento automático de fala (ASR) Gemini 3.5 Transcribe. O modelo suporta transcrição de streaming em tempo real e transcrição de áudio pré-gravado, podendo remover automaticamente palavras de preenchimento como 'hum' e 'é', conteúdos repetidos e lapsos de linguagem, ajustando os resultados da transcrição com base nas autocorreções subsequentes do usuário para gerar um texto mais adequado à leitura.

O Google afirmou que a latência de transcrição de ponta a ponta do Gemini 3.5 Transcribe foi reduzida em cerca de 70% em comparação com a geração anterior, Chirp 3. No benchmark multilíngue FLEURS, as taxas de erro de palavra (WER) no reconhecimento de fala em streaming e não streaming foram de 5,50% e 5,04%, respectivamente.