Sayansi ya kompyuta

Lugha ambayo haiathiri jinsi unavyofikiria kuhusu upangaji programu, haifai kujua.

Alan Perlis (1982)

software engineering

17 Julai 2026

Developers wenye uzoefu walihisi AI inawafanya wawe haraka huku wakifanya kazi polepole zaidi kwa kipimo — finding halisi, si verdict juu ya AI coding

Randomized controlled trial ya METR iliwaweka open-source developers 16 wenye uzoefu kufanya tasks 246 halisi kwenye codebases walizozijua vizuri, huku early-2025 AI tools (Cursor Pro pamoja na Claude 3.5/3.7 Sonnet) zikiruhusiwa kwa random half. Walitarajia AI ipunguze task time kwa ~24%; badala yake iliiongeza kwa 19% — na baadae bado waliamini imewafanya wawe haraka kwa ~20%. Perception gap hiyo ndiyo core robust ya study. Lakini ni developers 16, setting moja nyembamba na snapshot ya mapema 2025; waandishi wanasema wazi haisemi AI haimsaidii developer wa kawaida, na follow-up yao ya 2026 tayari inaelekea speedup, ikiwa na caveats zake.

kriptografia

9 Julai 2026

Uthibitisho wa kriptografia unaweza kuficha siri kwa kufanya ukosefu wa kiigaji kuwa mgumu kuthibitisha

Uthibitisho wa zero-knowledge humruhusu mtu kuthibitisha dai bila kufichua shahidi. Nadharia ya kawaida inasema huwezi kupata hilo kwa maana kamili kwa ujumbe mmoja, bila setup ya kuaminika na kwa soundness kamili. Paper ya Rahul Ilango haifuti kutowezekana huko. Inabadilisha lengo: badala ya kudai kwamba kiigaji kipo kwa kweli, inauliza kama proof system iliyochaguliwa inaweza kuthibitisha kwa ufanisi kwamba kiigaji hakipo. Chini ya assumptions kubwa za proof complexity na cryptography, hilo linatosha kurejesha, property kwa property, consequences za zero-knowledge zinazoweza kufalsifiwa na kujaribiwa katika game. Hii si primitive ya mtandao ya kuingiza moja kwa moja. Ni njia ya proof theory ya kubadilisha unprovability ya kihisabati kuwa kifuniko cha kriptografia.

AI ya kitabibu

5 Julai 2026

AI ya kitabibu inaweza kuwa private kwa wastani lakini bado ikafichua wagonjwa fulani — hasa waliowakilishwa kidogo

Modeli ya AI ya kitabibu inayoitwa ‘privacy-preserving’ mara nyingi hutegemea namba moja ya wastani. Utafiti huu unasema hiyo ndiyo test isiyofaa. Kwa kuchunguza membership inference attacks — ambazo hufichua kama rekodi ya mtu fulani ilikuwa katika training data na hivyo zinaweza kusaliti kwamba alikuwa na ugonjwa fulani — waandishi walipima hatari kwa kila mgonjwa badala ya kwa jumla, katika datasets saba za kitabibu na modeli nyingi. Pattern: modeli zinazonekana salama kwa wastani bado zinaweza kuruhusu baadhi ya watu kutambuliwa karibu kikamilifu (attack AUC ≥ 0.95); walio wazi zaidi ni kwa utaratibu makundi yaliyowakilishwa kidogo; na tatizo huzidi kadiri modeli zinavyokuwa kubwa. Waandishi hawasemi AI iachwe — wanasema faragha ipimwe kwa kila mgonjwa, access kwa modeli idhibitiwe na differential privacy itumike.

akili bandia

5 Julai 2026

Kuifundisha AI inayochora kuangalia ukurasa

Language models zinazogenerate vector graphics hufanya kazi blind — zinaandika drawing commands bila kuona result. Method mpya inaruhusu modeli kutazama canvas yake ikijaa stroke kwa stroke, na twist ya uaminifu ni kwamba kumpa eyes tu hufanya mambo kuwa mabaya: lazima i-retrainiwe kutumia feedback hiyo. Payoff ni modeli inayolingana au kupita kidogo rivals trained kwenye hadi mara 20 data nyingi zaidi — real, careful result kwenye benchmark moja, si revolution.

AI ya kliniki

5 Julai 2026

AI agent ilishughulikia patient cases nzima yenyewe — katika simulator, kwa records za zamani

MIRA ni aina mpya ya medical AI: badala ya kujibu swali moja, inashughulikia case nzima ndani ya simulated hospital record — kuchukua history, ku-order na kusoma tests, kufikia diagnosis na kuandika orders. Katika retrospective cases 574 kutoka public database, katika diagnoses nane pre-selected, waandishi wanaripoti iliwashinda physicians kwa diagnostic accuracy na kufanya decisions nyingi guideline-concordant na medication-safe. Kila qualifier katika sentence hiyo ni muhimu: ilifanya kazi sandbox kwenye past records, text only; edge nyingi zilitoka kwa conditions zenye clear-cut test results; ili-order karibu mara mbili blood tests kuliko doctors; na outcomes kadhaa zilipimwa dhidi ya kile original chart ilirekodi. Advance halisi ni agent inayotenda across whole workflow — si proof kwamba machine sasa diagnose better than doctor. Waandishi wanasema hivyo: generalization, safety na governance bado zinahitaji prospective real-world studies.

robotiki

25 Juni 2026

Je, “foundation models” kubwa za roboti kweli hufanya vizuri zaidi? Jibu la makini — ndiyo kwa kiasi, na tafiti nyingi haziwezi kutofautisha

Toyota Research Institute ilifundisha “large behavior models” — sera za roboti zilizopata pretraining kwa ~saa 1,700 za data mbalimbali za manipulation — na kuzilinganisha na sera za kazi moja za from-scratch kwa ukali usio wa kawaida: majaribio ya blind, randomized na sampuli kubwa (~1,800 halisi, 47,000+ simulation) pamoja na takwimu sahihi. Baada ya finetuning kwa kila kazi, modeli kubwa zilifanya vizuri zaidi kwa wastani, zilihitaji karibu mara 3–5 data kidogo maalum kwa kazi, na zilikuwa imara zaidi hali zilipobadilika; utendaji uliongezeka kwa ulaini na data zaidi ya pretraining. Lakini bila finetuning hazikushinda kwa uthabiti modeli za kazi moja, athari kadhaa zilikuwa ndogo kiasi cha kuhitaji sampuli kubwa ili zionekane, na chaguo la kawaida la data normalisation lilikuwa muhimu kuliko architecture. Ni msaada wa kiasi kwa mwelekeo wa robot foundation models — si roboti ya matumizi ya jumla, si zero-shot generalist, si “emergent leap” — pamoja na onyo kwamba robotiki nyingi huenda zinapima kelele.

akili bandia

21 Juni 2026

Kwa nini modeli za lugha hutoa hallucination — na kwa nini namna tunavyozipa alama huendeleza hali hiyo

Uongo unaotolewa kwa kujiamini ambao tunauita “hallucination” si hitilafu ya kifumbo: baadhi yake ni matokeo ya takwimu ya mafunzo, na huendelea kwa sababu vipimo vikuu hutuza kisio la kujiamini kuliko “sijui” ya uaminifu. Uchunguzi kifani wa modeli nne za kiwango cha juu unaonyesha kwamba kutaja kanuni za alama ndani ya maelekezo (“kanuni wazi”) hugeuza motisha hiyo.